Guillermo Rauch 用 Rust 和 Swift 重写 Mini 浏览器,弃用 Electron + Bun
Vercel CEO Guillermo Rauch 将 Mini 网页浏览器移植到 Rust 和 Swift,称其更快、更安全,且迭代体验优于 Electron + Bun。
Vercel CEO Guillermo Rauch 将 Mini 网页浏览器移植到 Rust 和 Swift,称其更快、更安全,且迭代体验优于 Electron + Bun。
9 月 24 日,腾讯操作系统层级的个人 AI 管家 Marvis 全量上线新版本,从「个人 AI 助手」升级为「个人 AI 管家」,并推出负责电脑、文件、软件和浏览器的 4 个管家。
硅谷101这期播客请到Scale AI研究总监何允中与伯克利博士后孙一铀,拆解AI数据行业:AfterQuery估值从4月的3亿美元升至9月的32亿美元,Bespoke Labs种子轮与A轮合计融资4000万美元。数据公司交付物已从标注打分转向Rubric评分标准与强化学习环境,OpenAI则于2026年2月以测试缺陷和数据污染为由停止报告SWE-bench Verified分数。
Anthropic 的 Claude Sonnet 5.5 已在 AI Gateway 上线,模型标识为 anthropic/claude-sonnet-5.5。
图灵奖得主、Ingres 和 Postgres 创始人 Mike Stonebraker 认为,为智能体 AI 提供数据的数据源都是关系型的,而基础模型只处理纯文本将成为重大弱点。
Perplexity 的 @AskPerplexity Computer 能以单条提示词(High Effort 模式)将一条房产房源转化为可交互探索的 3D 网站,效果对标 Matterport。
GitHub Copilot 应用支持并行运行多个智能体,每个会话拥有独立的 Git worktree 和上下文,因此可以同时进行构建、审查和测试。官方博客给出了上手方法。
一位 Devin 付费用户称,因 Cognition 拒绝其按季度付款的请求,他用两天时间基于自有基础设施搭建了替代方案 Hermes,功能与 Devin 几乎完全等价,成本约为 Devin 的 25%。该用户此前 Devin 使用量年化已超 10 万美元,原计划为获得 BAA(HIPAA 合规协议)将支出提升至约 1.5 倍。他认为问题不在 Devin 本身,而在于销售策略。
Logan Kilpatrick 预测 2027 年将迎来规模化自主创收(乃至盈利)的 AI 智能体与"迷你公司";这类形态目前已在亚规模化阶段出现,但仍有大量粗糙之处。
Aravind Srinivas 表示,最近几天把此前用 Fable 5.1 作为编排器的 50-100 个工作流改跑在 Opus 5.5 上,发现两者差异极小。但他仍有"没用上更聪明模型"的 FOMO,并向网友征集:哪些任务上 Fable 5.1 仍比 Opus 5.5 更强。
Hydrilla AI 宣布加入 Fish Audio Startup Program,将把生产级 3D 与富有表现力的语音 AI 结合。Hydrilla AI 表示其 3D 角色即将获得声音,并感谢 Fish Audio 团队的支持,双方将推进后续合作。
从 2022 年 11 月 30 日 ChatGPT 上线到 2026 年 9 月,AI 用不到四年从聊天框走向完整任务执行:LangChain、RAG 和 MCP 接上外部世界,Codex、Claude Code、Cursor 转向仓库级编程 Agent,Agent Skills 与 AGENTS.md 沉淀协作经验。
42章经播客对话开源项目 Vibe-Trading 作者、香港大学在读博士生吴浩哲,该项目开源半年已获 3.4w 个 Star。他提出在金融里决策很便宜、行动很贵,AI Trading 的核心是在近乎免费的判断与代价昂贵的交易之间建立可验证、可审计的通道,并拆解了 AI Trading 与量化的区别、系统的四大组成部分,以及 Jev 对交易帮助可能约等于零的看法。
黄叔将于 10 月 16-17 日在深圳第六届 HIPM 产品创新力峰会做 1 小时完整分享,内容是自己在 Agent-First 上三个月花 10 万元的踩坑经验。他称最近几个月很少出来,期待现场深度交流。
METR 开发并部署了一个基础的实时逐动作监控器,用 LLM judge 在智能体每次动作执行前审查,超过阈值即转人工审核并暂停评测,专注识别可能造成现实危害或试图绕过监控的行为。
AI Agent 管理平台 Paperclip 登上 GitHub 热榜第一,单日新增 2000 多 Star,总 Star 超 8.5 万,支持接入 Claude Code、Codex、Cursor 等 Agent,并提供组织架构、审批、预算与审计记录。
Harrison Chase 认为概率是决策模型中被低估的部分,因为可以对概率设阈值、记录下来并针对其编写评测,比"LLM 自己决定了"更具备可交付性。Hiếu Nguyễn Trung 也认同概率是最好用的部分,可以设阈值、记录日志并写测试。
Fireworks 的 Ember-1 已在 Vercel AI Gateway 上线,这是一个基于 Kimi K3 构建、面向编码与智能体工作流的研究预览版推理模型。
OpenAI 即将推出名为 o 的新产品,据称是云端 Agent 产品,对标 muse。来源提到"人人都还要有一台云电脑",并建议有换电脑、换手机需求的人尽快下手,称涨价是必然。
Google Antigravity 2.0 新增 planning mode,输入 /plan 后智能体先退一步思考任务、做大量调研,再生成实现计划供用户审阅,执行前需用户批准;也可在提示词中直接要求计划以获得更轻量版本。Varun Mohan 回应称该功能 2025 年已加入、今年早些时候从产品中删除,此次是以可选斜杠命令形式重新加回,并承认时机不佳。
给 Astra 几段参考视频、几张 Finn 的照片和一段性格描述,它便自行生成图像,再经 Seedance 2.5 转成视频,全程不到 1 小时,其中通过 fal 的 API key 调用。作者展示了这次生成的镜头板。
硅谷101将在Alignment 2026期间举办STORY101 LAB AI视频黑客松,10月10-11日在加州Sunnyvale举行,要求现场用AI完成一部不超过三分钟的视频作品。活动设探索与进阶双赛道,吸引20支团队、80位选手参加,设六个美元现金奖项,Runway作为AI tool partner为获奖者提供额外算力奖励,一等奖作品将在硅谷101后续视频展示并有主会场展映机会。
MIT 教授 Philip Isola 提出,AI 可能正进入 robot-use agents 时代:通用模型能控制不同机器人、编写策略,并在几乎无需机器人专项训练的情况下学习新物理任务。
HackerNews 上一篇文章《Plan Mode 已死》提出,随着大模型能力飞跃,写给人看的冗长 plan 需求大幅降低,应改用 understand → act → inspect → clarify → adjust → act again 的边做边改流程,而非先产出待批准的 spec。
LibTV 1.5 上线,原 Agent 升级为 TV Director,新增剧本原创及改编、角色造型室、导演执导、3D-BOX、创意片头五项核心能力。剧本支持像编辑文档一样直接手改,TV Director 可自动在画布上创建人物、场景与道具资产节点,并支持手动模式逐步确认以控制积分消耗。分镜阶段可用 Seedance 2.5 样片模式先出 480p 视频,确认后再一键无损高清。
Viking 分享了一个设计与交互技巧:让 agent 往界面里塞各种 edge case,比如超长或超短文本、各种极端数字,观察 worst-case 布局表现,再对着截图做 UI review 并按问题清单修复。
微软 CEO Satya Nadella 在 Sources Podcast 访谈中称,agent 时代创造的市场规模会比云计算大几个数量级,并批评 AI 行业只顾炫技、忽视普通人真实体验。
Anthropic 开源 financial-services 仓库,提供面向投行、股票研究、私募股权、基金运营和财富管理的金融 Agent 参考实现,把金融工作拆成命名 Agent、垂直 Skills、MCP 数据连接器和 Managed Agent Cookbooks 四类可复用资产。
Replit Agent 本周接入 GPT-6 Sol、GPT-6 Luna Fast 和 Claude Opus 5.5 三款新模型,供用户试用并匹配自己的工作流。
对 16 款前沿 VLM 的文档解析评测显示,提高 effort 通常能改善 PDF 读取表现,Opus 5.5 在同价位中性能最强,尤其擅长解析表格;Astra 表现也不错但起价更高,GPT-6 Luna 在低价端更有吸引力。
Replit 收购 AI 商业分析公司 Atta,Atta 团队 Omar、Amine 等加入。Atta 让用户无需写 SQL、无需清理 AI 生成内容,连接数据即可完成业务分析与可视化,今年早些时候已有两家上市公司用 Atta 跑 Q1 QBR,其中一家 50 位高管用 Atta 构建的 deck 和 doc 替换了原有 SaaS 工具。
Latent.Space 发布访谈,OpenRouter 联合创始人 Alex Atallah 与 Anjney Midha 解释 Stripe 收购 OpenRouter 的原因,并谈到日均处理 10T+ tokens、模型路由业务,以及从 Llama 和 Mistral 时代成长为开发者的中立分发层。
花叔基于 Anthropic 工程师复盘 claude.ai 与 Claude 桌面端两周提速约 3 倍的方法,整理出开源 skill「闪电.skill」,含 8 个步骤和测速、棘轮两个脚本,可通过 npx skills add alchaincyf/huashu-flash 安装。
Pika 推出 API Club Member Spotlights,展示使用 Pika API 构建产品的开发者与小团队。首家聚焦的东京 AI 工作室 AI-Bridge 提供视频制作、企业培训和定制 AI 工具,加入 Pika API Club 后其生成媒体成本减半。
HeyGen 推出 Custom looks 功能,可让用户给数字人换上任意服装,同时保留其原本辨识度。演示中他们借用 Meta 首席 AI 官 Alexandr Wang 的造型,展示了同一数字人在每周 Slack 更新视频里的换装效果。
Notion 透露,ChatGPT、Claude 等 AI 工具已成为用户回答"你是如何听说 Notion 的?"时的首要来源。这一变化经历了从缓慢积累到突然加速的过程。
GitHub 官方账号抛出讨论:聊天是否永远是合适的 UI?@burkeholland 认为不是,至少在 GitHub Copilot 应用中有了 canvases 之后并非如此。该观点以文章形式发布,帖文互动量为 56 条回复、20 次转发、234 次点赞。
Sam Altman 表示 OpenAI 正持续审查智能体在训练和评估期间使用互联网访问的行为,并已在下方链接发布摘要,因需从数 PB 级智能体活动日志中厘清情况,进度未达预期。他强调目前 Hugging Face 事件仍是所见最严重的一起,审查按严重程度优先处理并追加资源,预计需数月完成;其余多数案例严重性较低,对第三方服务影响有限或没有实质影响。
OpenAI 表示,在 Hugging Face 事件后已承诺对模型在训练和评估中的行为开展更广泛的审查,并公开发现。审查中绝大多数行为是完成常规研究任务,如访问公开网页内容回答问题;调查重点在于智能体以超出任务或预期方法的方式与第三方网站交互的情况,目前多数案例严重程度较低,对第三方服务的影响有限或没有实质证据。OpenAI 称,鉴于审查规模需逐案评估,这项工作预计还需要数月才能完成。
Harrison Chase 认为 Jev 与 LangGraph 是绝佳组合:把 AI 智能体建模为复杂系统、让 AI 深度融入其中非常合理,LangGraph 是这类建模的最佳方式,而在 LangGraph 内用 Jev 加速各类小决策效果出色。该观点引自其转发的 Sydney Runkle 文章。