Sarah Guo 押注 AI 前沿实验室无法包揽一切:专访 Conviction 创始人
2018年,28岁的 Sarah Guo 成为 Greylock 60年历史上最年轻的普通合伙人,四年后离职创办全押 AI 的 Conviction。她早期投资了 Baseten 和 Harvey(各估值超 110 亿美元),首年又投中 Sierra、Cognition 和 Mistral(三家合计估值 540 亿美元)。
2018年,28岁的 Sarah Guo 成为 Greylock 60年历史上最年轻的普通合伙人,四年后离职创办全押 AI 的 Conviction。她早期投资了 Baseten 和 Harvey(各估值超 110 亿美元),首年又投中 Sierra、Cognition 和 Mistral(三家合计估值 540 亿美元)。
一位用户分享用 Claude Cowork 管理日历的提示词:让 Claude 规划一周日程,把会议控制在 20 小时以内,合并冲突会议,并参考过往几周判断哪些会议会被拒绝,晚餐不计入 20 小时,更新邀请前先征求确认,同时构建一个可迭代打磨的技能。
播客「屠龙之术」在约50分钟节目中梳理2026年上半年AI行业变化,从资本与硬件、模型竞争、Agent元年、世界模型与治理四条线索重估产业方向。节目提出2026年可能成为Agent从聊天走向任务执行的关键年份,Coding Agent、办公智能体与Agent基础设施将重构软件生态,并讨论OpenAI、Anthropic、Google及中国模型厂商的格局变化与中美开源闭源路线分野。
Grok 4.5 在 Proximal 的 FrontierSWE 基准上综合实现与性能排名第 2,研究能力排名第 1,仅次于 Claude Fable 5,领先 Opus 4.8、GPT-5.5 和 GLM-5.2。
Satya Nadella 转发 Demis Hassabis 的文章,称需要更多这类思考,并提醒目标是构建促进创新与选择的前沿生态,同时避免任何单一模型"掉线"就导致世界崩溃。
Claude 的 Artifacts 获得升级,现在支持公开分享和多人协作编辑,并可在 Claude Code 中使用,也能通过 Claude Tag 创建。发布信息来自 ClaudeDevs 的引用推文。
Epoch AI 估算,向免费聊天机器人发送 100 词提示词生成回复约耗 0.6 Wh 电,比微波炉运行 10 秒还少。AI 目前仅占美国年用电量的百分之几,低于空调(12%)和照明(8%),但数据中心电力需求大约每年翻一番。
从 Palantir 到 OpenAI、Anthropic,顶级 AI 公司正纷纷组建 FDE(前线部署工程师)团队。本期播客讨论 FDE 与 CSE 的角色差异,以及 AI 落地中"模型能力"与"业务价值"之间的鸿沟——为何企业 AI 需要有人深入现场完成最后一公里。节目还探讨了 AI Agent 会取代 SaaS 还是成为连接软件生态的超级触手。
Anthropic 将 Claude Fable 5 的访问权限扩展到所有付费计划,并将 Claude Code 的每周速率限制提高 50%,该政策持续到 7 月 19 日。
Nathan Lambert 认为开放权重模型正面临迄今最严峻的监管考验,多项信源提到白宫正在讨论通过新行政令管理开放模型,但尚无官方信息,可能只影响中国来源模型与政府用途。
JetBrains 用 Claude Code 在 SkillsBench 的 86 个编程任务上实测 Caveman 电报体 Skill,发现输出 Token 实际只降 8.5%(从约 59.2 万降到 54.2 万),远低于其宣称的 65%。
宝云区分 ChatGPT 三种模式的定位:Chat 回答问题,Work 跨应用完成知识工作交付成品,Codex 在代码仓库里完成开发任务。Work 与 Codex 共享同一“智能体用量”额度池,而 Chat 额度独立;二者底层是同一套 Agent 能力,分别面向办公与软件开发两类场景。
Cognition 联合创始人 Scott Wu 称自己成长于路易斯安那、身边没人会写代码,如今在 Cognition 由 cog 团队带着工作。他转发的调查显示,在"身边有才华的人密度最高"的公司投票中,Cognition 与 Anthropic 各获 9 票并列第一,Modal 以 5 票居第三,OpenAI 4 票,Standard Intelligence 与 Cursor 各 3 票。
OpenAI 将 GPT-5.6 定位为小版本更新,实则把 ChatGPT、Codex、GPT Live 和 ChatGPTWork 塞进同一个入口,走向美国版超级 App。
Claude Code 桌面端新增内置浏览器,Claude 可以在应用内打开并交互任意网站,包括生产环境应用、文档、设计稿,其读取和点击方式与操作本地开发服务器一致。该功能支持沙箱隔离且可配置,用户可自行选择会话是否持久保存。引用推文称它能打开收到的链接、查看 Twitter,甚至观看 FIFA 世界杯。
爆料者 leo 称 GPT-5.6 将是 5.x 系列最后一个模型,OpenAI 决定直接推 GPT-6,并在一个月内(甚至 7 月底)发布。
有人提议在 Kickstarter 上众筹一款 Claude Clock。原帖仅此一句,未透露该时钟的具体功能、价格或上线时间。
Anthropic 将于太平洋时间明天上午 10 点举办直播,讲解从单机版 Claude Code 到多人协作的 Claude Tag 的演进,并深入拆解 Claude Tag 的工作原理。Claude Tag 可监控频道、主动执行任务,全团队都能对其下达指令,它还能记住你上周告诉它的内容。
Anthropic 在 Q2 2026 的 RSI 博客称其贡献者日均合并代码量是 2021-2024 年的 8 倍。基于 Cobb-Douglas 与 CES 生产函数建模,Thomas Kwa 推断仅凭编程智能体带来的研究员提效就超过 2 倍:Cobb-Douglas 在 β=0.5 下给出约 2.83 倍,CES 均质代码情形为 [2.75, 2.91]。
Claude Cowork 开始向 web 和移动端推送,Chat 与 Cowork 在 web 和桌面端共用一个 home tab,统一了侧边栏、搜索以及 Projects 与 Artifacts 的入口位置。作者表示后续还会有更好的 Chat 与 Cowork 整合。
播客「AI 炼金术」中,徐文浩分享做大项目的 Harness 设计,认为纯 vibe coding 做大项目一定会塌掉,但不该得出 AI 没用的结论,而是要靠一整套基建管理复杂度并持续迭代。
Anthropic 发布了一份由 Claude Code 早期团队成员和首批用户共同讲述的简短历史,回顾这款产品从无到有的过程。完整内容可在 Anthropic 官网的 "making of" 专题页面查看。
Import AI 464 汇总多项 AI 研究进展。Fable 在 KernelBench-Mega 上以单次协作 kernel 启动实现 18.71X 加速,超过 Claude Opus 4.8、GLM-5.2、GPT 5.5 等用 Triton 的尝试。
Claude Code 团队把“循环”定义为 AI 智能体不断重复执行工作周期直到满足预设停止条件,并按触发方式、停止条件、所用基础指令和适配任务四个维度分类。
有用户分享用 Claude Code 搭配 workflows 和 artifacts 搜寻候选人的用法:向 Claude Code 描述职位与目标背景,让它启动动态工作流找出 100 名候选人,并为每人附上 LinkedIn、Twitter、博客、播客及一句话简介,再生成 artifact 邮件发送,随后可在离开电脑后随时查看结果。
Claude Fable 5 在用户的留存分析中未经提示便自动使用了倾向得分匹配,将用户按活跃度对齐后再做同类比较。用户称 Fable 5 在各类任务中的判断力均有提升,包括在 Cowork 中撰写邮件和文档、在 Claude Code 中调试复杂错误。
Lilian Weng 在 Lil'Log 发表长文,系统梳理 harness engineering 与递归自我改进(RSI)的研究脉络。文章把 harness 定义为围绕基座模型、负责编排执行与上下文管理的系统,并归纳出工作流自动化、文件系统作持久记忆、子智能体与后台任务三类设计模式。
有用户提示,可让 Claude Code 借助 computer use 功能自动完成 Claude Tag 的配置:只需把它指向 Claude Tag 文档,它就会为团队接入 GitHub 仓库、数据仓库、Google Drive 及其他数据源。
Fable 5 回归,@_catwu 邀请开发者在这个长周末用它做项目,并在评论区展示 demo。原帖引用了 Claude @claudeai 的相关推文。
Smashing Magazine 文章指出,用户真正需要的不是更多新工具,而是契合既有心智模型的无缝集成,用来解决高频、高严重度、高挫败感的问题。文章推荐"Quiet AI",即隐于后台默默做事、不争抢注意力的助手,并以 Claude 集成 Microsoft Excel、PowerPoint 和 Word 为例。
Anthropic 于北京时间 7 月 2 日凌晨在 X 上解禁 Fable 5 模型,播客主播称其智商与任务完成质量有明显提升,适合讨论和写 Spec。但该模型对订阅用户仅开放套餐额度的 50%,消耗比 Opus 4.8 快,且只能用到 7 月 7 日。
Claude Code 的 Artifacts 功能现已面向 Pro 和 Max 套餐开放,用户提出需求后 Claude 会编写代码并实时发布到 claude.ai,在持续工作时同步更新。生成的页面为账号私有且完全自包含。
Anthropic 为 Claude Enterprise 组织提供 2.5 万美元额度、为 Claude Team 组织提供 2500 美元额度,用于在 9 月 1 日前使用 Claude Tag。用户可通过 claude.com/product/tag 开始使用。
Claude Tag 正在 Anthropic 的工程、产品、数据、销售、市场等部门铺开,其内部版本已能产出 65% 的产品 PR。Boris Cherny 与 Cat Wu 在对话中讲述了从 Claude Code 到 Claude Tag 的路径,以及它如何从工程团队扩散到整个 Anthropic,并介绍了安全设计的思路与 CEO/CTO 的推广方法。
Claude Fable 5 现已在 Devin Desktop 和 Devin CLI 中可用。该模型同时接入 Devin Cloud 的 Ultra agent,官方称其擅长长周期任务与调试。
Poe 宣布 Claude Fable 5 和 Gemini Omni Flash 现已上线该平台。Fable 5 是 Anthropic 最强大的模型,短暂下线后重新向公众开放;Gemini Omni Flash 支持对话式视频创作与编辑,官方将其比作 Nano Banana 的视频版,借助世界理解实现真实运动与一致性编辑。
Epoch AI 的数据分析显示,2026 年 6 月多家机构披露约 1500 个高危和严重级 CVE,超过 Mythos 发布前月度纪录的 3.5 倍。
晚点聊发布 2026 年 Q2 AI 季报,嘉宾为 MoE Capital 创始合伙人 Henry Yin,围绕推进智能前沿和智能扩散两条脉络回顾本季度进展。
Claude Fable 5 已重新回到 v0 平台,用户可通过 v0.app 上的专属入口试用。
Claude 的 Fable 5 宣布回归。该消息由 Alex Albert 发布,正文仅提到「Fable 5 is back」并附有一段视频,未披露具体版本、参数或可用性信息。