Eazo 发布:Personal Agent 的起点是 Agent,终点是 Person
谢扬团队国庆期间正式发布 Personal Agent 产品 Eazo,以定制 App 为中心,用户用自然语言描述需求,Agent 生成 6 个以上视觉方向并完成前端、后端、数据库、登录与 Stripe 收款,自带 49 个 AI 模型。
谢扬团队国庆期间正式发布 Personal Agent 产品 Eazo,以定制 App 为中心,用户用自然语言描述需求,Agent 生成 6 个以上视觉方向并完成前端、后端、数据库、登录与 Stripe 收款,自带 49 个 AI 模型。
a16z 发布 Ben Horowitz 与 TypeSafe AI 的 Diogo Almeida 对谈,主推其"build prod, not God"路线。Diogo 透露其模型意外每天服务数万亿 token,29.4% 的《财富》500 强客户找上门,并于 3 周前从 a16z 完成一笔大额 A 轮融资。他称大多数 AI 圈内人"没搞懂",只把问题当成分类器层面的抱怨。
TypeSafe AI 的 Diogo Almeida 认为,SaaS 将是整个 AI 游戏的最大赢家之一,他看好与最"无聊"的大型 SaaS 公司深度合作,因为这类公司最清楚哪些工作流该被自动化。他反驳"SaaSpocalypse"中软件易于复制的说法,称大量能力藏在底层,并称未来将出现"反向 SaaSpocalypse"。
EngramLab 联合创始人 JessyLin 将在 Fireworks Forge 分享如何构建具备原生记忆的智能体,探讨智能体能否像在上下文里一样把信息记在权重中。活动于 11 月 3 日在旧金山举行,报名链接为 bit.ly/forgex。
OpenAI 推出 GPT-6.1 Sol 的 Ultrafast 版本,速度是标准版的 8 倍,官方称智能水平与标准版一致且逼近旗舰 Astra。
微软在 Windows and Surface 活动上公布了把 Windows 打造成智能体操作系统的计划,核心是让 Windows 用上免费本地模型而非昂贵云端模型的混合智能。
TypeSafe AI 于 2026 年 9 月 15 日推出 Jev,并宣布获得 DCVC 领投的 4,000 万美元种子轮融资。Jev 不聊天不写文本,接收 state 与 typed questions,返回带校准概率的 Choice、Score 和 Noul 答案,通常耗时 70 到 500 毫秒,输入每百万 tokens 收费 0.042 美元、输出免费。
梳理 Jev 的十类真实用例与每类成本延迟数据,可对照现有 LLM 工作流判断哪些小决策值得下放。
Madrona 第五届 IA40 峰会以「释放 AI 价值」为主题,讨论重心已从模型本身转向由模型、工具和智能体界面组成的 AI 系统。Vercel 称其 56% 的生产部署已由智能体完成,微软 15 至 20 人团队能在六个月内完成过去数百人多年的工作量。IA40 六年 164 家上榜公司累计融资超 $500B,今年 23 家重复上榜。
微软在 10 月 8 日的 Windows 发布会上宣布将混合智能引入 Windows,通过模型路由、Windows ML 和本地 AI 能力,让 Copilot 等产品按任务复杂度、成本和隐私要求在云端与本地模型之间自动切换,GitHub Copilot 的 HydraFusion 首次可直接调用运行在 Windows PC 上的本地模型。
微软把混合智能与模型路由引入 Windows,并让 GitHub Copilot 直接调用本地模型,读者可了解 AI PC 向 Agent 运行环境演进的具体路径。
17 位科技高管在 Business Insider 于旧金山举办的 AI Insider 晚宴圆桌讨论上,分享了 AI 智能体如何改变工作与招聘。相关报道由 AI Insider 栏目作者 Alistair Barr 撰写。
阶跃星辰(StepFun)的 Step 5 Preview 发布一天后登上 OpenRouter Trending 第一,并已接入 Kilo Code、Cline、Hermes Agent 和 OpenCode。
Figma 提示,找到目标后可直接在聊天中交给 Figma agent 处理。该帖未披露具体功能名称、版本号或可用范围。
LangChain 发布 Managed Deep Agents 0.9,为 Slack 频道新增 Reactions API,可用启发式规则、决策模型或自定义逻辑构建加载状态与回执。该功能瞄准智能体用户体验中被低估的加载状态环节。
Anthropic 启动长期项目 Cyber Mission,并推出免费的 OSS AI 扫描器,定期检查开源项目、自动标记并解释漏洞、给出补丁建议;其关键基础设施防御计划(CIDP)向电网。
Ben Thompson 在 Stratechery 周报 2026.41 中发布《Apple 与黑客的未来》,讲述自己在 AI 时代对 Apple 封闭生态日益不满,认为消费科技未来将走向完全定制与完全整合两极;同期他还与 Facebook 前全球选举负责人 Katie Harbath 对谈科技对政治的冲击。
TypeSafe AI 正在为软件打造 AI,目标是让 AI 不只是服务"人在环路",而是真正构建真实软件。Diogo Almeida 称智能将出现大量成本与速度的权衡,超级系统型的人会据此做取舍,而 Jev 会聪明 1000 倍;人们也会因此创造出新的工作类型,这正是 Jevons 中"Jev"的由来。Martin Casado 认为我们获得了新原语,可以重新构建系统。
ColaOS 创始人橘子在与「AI 炼金术」的对谈中复盘个人 Agent 这半年:flash 级模型让看邮件、订机票等任务的 token 成本降到当时的几十分之一,单用户月补贴从数百美金降至十美金左右,补贴成本已低于获客成本。他为此放弃卷办公赛道,转向做「996 之外」的个人 agent,并称 Opus 5.5 已把世界模型的活吃掉。
2026 年 9 月 GitHub 十大热门项目榜单从约 23 个候选中选出 ponytail、ECC、open-code-review、hindsight、WeKnora、cua 等十个项目,覆盖编码 Skill、Agent Harness、代码评审、Agent Memory、知识 RAG 与 Computer-Use 等方向。
用户让 Grok @bot 读取自己的 GitHub 项目并生成宣传视频,随后展示了 Grok 给出的成品。该推文获得 3 次转发、51 次点赞和 37823 次浏览。
Pine Computer 正式发布,定位为"为 AI 而生"的计算机,而非把 AI 塞进为人类设计的重型框架中。其提出 AI 已足够聪明,真实任务慢、贵、不可靠的瓶颈在于运行环境。发布者建议阅读报告并对比 Pine Computer 对团队的成本影响,称将自行测试后再分享。
Google 发布 Android Bench 2.0,新增长周期任务(LHT)、智能体评测与连续评分,从原先的二元通过/失败改为按功能、视觉保真度和回归情况计算完成率。其中将跨平台应用移植到 Android 的最佳模型完成率仅 80%,被列为公开难题。榜单显示 Claude Opus 5.5 以 32% 的 LHT 通过率居首,GPT 6 Astra 以 28% 次之。
Surge 发布 sudo L7 新基准,用于衡量 AI 距离 staff 级软件工程师的水平——结论是"我们走了一半"。该基准含 60 个任务,多数来自真实公司的私有生产仓库,由真正负责过这些系统的工程师编写,评分维度涵盖功能正确性、工程手艺、架构判断、协作与冗余复杂度。表现最好的智能体仅能成功完成约 45% 的任务,coding agent 仍停留在 L3 水平。
LangChain 简化了智能体的认证、记忆与频道,并为 Managed Deep Agents 引入预置网页搜索工具。相关细节来自 Victor Moreira 在 Interrupt NYC 的完整分享。
LangChain 开放 Interrupt 大会录像归档,所有场次均可按需点播,地址为 interrupt.langchain.com/recordings。其 Managed Deep Agents 简化了智能体认证、记忆与渠道,并引入 web search 作为预置工具,@VictorMoreira16 的 Interrupt NYC 完整场次已在 YouTube 上线。
AI 硬件初创公司 Natura 于 10 月 8 日发布智能戒指 Interface,早期入手价 99 美元,按住戒圈按钮说话即可把任务交给指定 AI 代理执行,支持 Meta Muse、Instinct、Grok Bot、Claude、ChatGPT 等,无需掏出手机。
Arize AI 的 Aparna Dhinakaran 将于 10 月 13 日登上 keynote 舞台,探讨当 AI 智能体承担构建工作后 AI Engineer 的角色定位,以及"好"由谁定义、如何衡量。Arize AI 是本次大会的 presenting sponsor,活动于 10 月 12 日至 14 日在纽约举行。
Postman 披露其 Agent Mode 运行在 Amazon Bedrock 上,服务 4000 万开发者。团队发现工具数量超过约 40 个后工具选择错误上升,于是将 170 多个工具按任务动态收窄至约 15 个;同时把上下文而非模型能力视为主要瓶颈,并采用亚马逊云科技跨区域推理、多级提示词缓存,以及修改应用状态前需用户批准的设计。
Amazon Bedrock 九月更新中,OpenAI 的 Astra、Sol、Luna 系列模型正式可用,其中 GPT-6 Astra 支持最高 100 万 input tokens,GPT-6 Astra Ultrafast 提供最高 6 倍推理加速、300 tokens/秒。
安全公司 Zenity Labs 称,Amazon Bedrock AgentCore 上单个可公开访问的 AI 智能体足以接管同一 AWS 账户和区域内的所有 AgentCore 智能体,该漏洞链被命名为 AgentCorruption。
The Vergecast 新一期节目中,David 和 Nilay 盘点微软、Amazon、Apple 近期推出的新硬件,讨论这些设备围绕 AI 助手与智能体打造的策略是否走对了方向,以及"AI 应该来运行电脑"这一思路本身是否成立。节目还谈及 Amazon 的硬件野心、微软新版 Surface、Googlebooks 能否成为 AI 笔记本的未来,以及"智能 UI"的设想。
Tim Ferriss 与 Kevin Rose 在《The Random Show》第 886 期中聊到能通过短信打理生活的 AI 超级助手和智能体购物。节目还涉及攀岩耐力补剂 beta-alanine、核桃与精子质量、梦境工程与麻醉梦境、The Dark Wizard 以及 Tim 即将出版的新书。本期由 Timeline Mitopure、Shopify、Fin 和 Gusto 赞助。
笔记侠文章认为,AI 大周期可能是 80 后的最后一次机会。作者指出移动互联网主浪在 2009 到 2018 年,张一鸣、王兴等 80 后创业者当时 25 到 35 岁;AI 这波奖励的是行业经验,YC 最新一批近 200 家公司中 56 家在做智能体,医疗企业 22 家排第一。文章给出三个动作:老板先做重度用户、从工作流切入、把生意壁垒做深。
ElevenLabs 与 Banner Health 达成合作,用 AI 语音智能体接听患者来电,首批落地初级护理预约场景。患者可全天候致电,由 ElevenAgents 直接在 Banner 的电子病历中完成预约、改约或取消;需要人工时,通话会连同必要上下文转接给 Banner 团队成员。
歸藏(guizang.ai)将「让 Grok bot 每天早上定时生成 AI 早报视频」的流程做成了一个 bot 并发布,用户可通过 x.ai/bot/8mi67EcgDU 一键安装。该流程全程运行在 Grok bot 的云端虚拟机上,无需本地电脑,覆盖内容收集、写代码和视频渲染,配套提示词可直接复制使用。
a16z 发布第 7 版《全球消费级 AI 应用 Top 100》,并首次按 2026 年 8 月 C 端付费金额发布全球 Top50 toC AI 应用收入榜,仅 ChatGPT、Claude、Perplexity、Suno、Photoroom、Canva、Notion 7 款产品同时登上三份榜单。
《State of AI Report 2026》10 月 8 日发布,第九期由 Air Street Capital 的 Nathan Benaich 牵头,正文 240 多页,分研究、产业、政治、安全、预测五部分。
elvis 分享了对智能体视频创作工具 Syren Video 的观察,该工具会从用户的素材库中学习其风格,包括常用的图形、动效和剪辑节奏,用户再通过提示词生成新视频并在对话中修改。
v0 上线 Meta VR 模板,开发者描述想法并部署后即可在 Meta Quest 上打开使用。该模板由 v0 与 Vercel 合作推出,已适配 Meta VR Glasses,内置注视与手势输入。
Nano Banana 2.1 在三项 Image Arena 模式中均进入前六:Multi-Image Edit 第 4(1431 分)、Text-to-Image 第 5(1328 分)、Image Edit 第 6(1428 分)。
Arena.ai 推出 Arena Alignment Index,这是一个衡量 AI 智能体在真实使用中安全与对齐表现的基准,数据来自 27 个模型的 90K+ 真实智能体会话。