Anthropic Claude Sonnet 5.5 上线 Cosmos,逐步替换旧版 Sonnet 模型
Anthropic 的 Claude Sonnet 5.5 已在 Cosmos 上线,Augment Code 将在未来几天把它接入自家 agent loops,替换此前的 Sonnet 模型,并跟踪它对软件工厂交付内容的影响。
Anthropic 的 Claude Sonnet 5.5 已在 Cosmos 上线,Augment Code 将在未来几天把它接入自家 agent loops,替换此前的 Sonnet 模型,并跟踪它对软件工厂交付内容的影响。
Fireworks 发布首个路由模型 FireRouter with Opus,常规任务交给顶级开源模型,其余由 Claude Opus 处理,并支持缓存与任务感知路由。官方称在编码会话中达到 Opus 98.1% 的准确率,单次会话成本降低 57%。
Anthropic 发布 Sonnet 5.5,称其能力几乎与 Opus 5.5 相当,价格只要一半,同时 Haiku 5.5 也在路上。
Simon Willison 指出 Sonnet 5.5 最重要的变化是它现在驱动 claude.ai 的免费层,因此这些能力免费用户也能使用。他同时提到 ChatGPT 免费层仍是能力更弱的 GPT-5.6 Luna,并引用了一组 Sonnet 5 与 Sonnet 5.5 的早期实验对比,其中包含一个用两者分别制作的秋季落叶模拟器。
Claude 发布 Sonnet 5 与 Sonnet 5.5 的弹跳球物理测试对比,两者使用来自 @forwardeditor 的同一提示词生成。结果以视频形式在 Twitter 展示,该帖获得 234 次点赞和约 10 万次浏览。
Anthropic 的 Claude 账号发帖询问用户正在用 Sonnet 5.5 探索什么,该帖获得 179 个点赞、44 条回复和 52626 次浏览。帖子未披露 Sonnet 5.5 的任何新功能、参数或发布信息。
@kevin_t_ngo 做了一款外观像方格纸上涂鸦的流程图工具,可拖动图形、连接节点,也能在上面手绘。该工具在浏览器中运行,相关演示视频已发布。
Claude 官方账号展示了一组对比:给 Sonnet 5 与 Sonnet 5.5 同一个提示词,分别用 JavaScript 生成不到一分钟讲完恐龙史的动画,由 @kevin_t_ngo 创作。该演示发布在 Twitter 上,获得 693 个点赞、23 次转发和约 28 万次浏览。
@measure_plan 用代码实时渲染出森林树冠间穿透的光线,画面与声音均由代码编写。该演示在浏览器中播放,帖文获得 301 次点赞、41163 次浏览。
Claude 官方分享了一批 Claude Sonnet 5.5 的早期实验作品,其中 @_re_pete 用 Sonnet 5 和 Sonnet 5.5 分别制作了秋叶模拟器进行对比。该帖获得 7940 次点赞、357 次转发和 74.7 万次浏览。
Cognition 转述 Anthropic 的数据:Sonnet 5.5 的 token 价格与 Sonnet 5 保持一致,但输出生成速度提升超过 30%,单任务成本最多降低 30%。同一价格下的速度与成本变化,对使用 Claude 驱动编码智能体的团队更直接。
Cognition 宣布 Claude Sonnet 5.5 已在 Devin Desktop 和 Devin CLI 中可用。在 FrontierCode 1.1 Main 上,Sonnet 5.5 得分 64.4%,高于 Sonnet 5 的 56.2%,并超过以 extra high reasoning effort 运行的 Fable 5.1。
Cursor 宣布 Sonnet 5.5 现已在 Cursor 中可用。官方称其表现强劲,在许多任务上与 Opus 相当。
Anthropic 发布中杯 Sonnet 5.5 模型,作者称其在 Agentic Coding 测评中分数比自家大杯 Opus 5.5 更高,其他分数与 Opus 5.5 相差无几,而定价不到 Opus 5.5 的一半、只有 GPT-6-Astra 的四分之一。
Claude Haiku 5.5 将在未来几周发布,补齐 Claude 模型家族。该消息由 Mike Krieger 在社交平台发布,未披露参数规模、上下文长度或具体上线时间。
Mike Krieger 表示自己大部分工作仍使用 Opus 5.5,但 Sonnet 5.5 是很好的补充,他喜欢其设计技能,认为它很适合构建功能,现在常用它来制作 Artifacts,并邀请用户试用反馈。
Claude Sonnet 5.5 发布,是 Claude 5.5 家族的第二款模型。相比 Sonnet 5,它运行速度快 30% 以上,多数工作场景成本最多降低 30%。
NVIDIA 与 100 多家行业伙伴推出 Open Agent Safety Platform,整合 OpenShell 与 Sentry,目标是构建安全智能体系统的信任层。黄仁勋称这不只是一款产品,而是一个开放生态的开端,安全与创新并不冲突,信任是 AI 经济的基础。
Anthropic 推出 Claude 5.5 家族第二款模型 Claude Sonnet 5.5,官方称其相较 Sonnet 5 提速超过 30%,多数工作成本最多降低 30%。在 Claude Code 中,用户完成任务量比 Sonnet 5 多约 30%,且完成同样工作所需 token 更少;演示中用工具调用扫落叶时比 Sonnet 5 快 24 秒、少用 6K token。
原文给出 Claude Sonnet 5.5 在 Claude Code 中的任务完成量、速度与 token 消耗变化,可据此判断升级收益。
Anthropic 的 Claude Sonnet 5.5 现已在 GitHub Copilot 中正式可用,面向构建功能、修复 bug 等范围明确的日常工作。GitHub 称早期测试中它在编码任务上与 Sonnet 5 表现相当,但使用的步骤、token 和工具调用明显更少,完成任务的速度也更快。用户可在 GitHub Copilot app、CLI 和 code 中试用。
Anthropic 推出 Claude 5.5 家族的第二款模型 Claude Sonnet 5.5,相比 Sonnet 5 运行速度提升超过 30%,多数任务成本最高降低 30%。Alex Albert 评价其写作清晰、速度快,相比 Sonnet 5 有明显能力跃升,适合用于反复迭代。
AI SDK 已支持通过 Anthropic 和 Claude 接入,相关说明见 ai-sdk.dev 的 AI SDK 提供商文档。该消息由 AI SDK 官方账号发布,并同时 @AnthropicAI、@claudeai 与 @vercel。
Claude 推出 Claude 5.5 家族第二款模型 Claude Sonnet 5.5,相比 Sonnet 5 运行速度快 30% 以上,多数任务的成本最多降低 30%。AI SDK 表示可以在 AI SDK 中使用 Claude Sonnet 5.5。
Anthropic 推出 Claude Sonnet 5.5,是 Claude 5.5 家族的第二款模型,已可在 v0 使用。相比 Sonnet 5,官方称其运行速度提升超过 30%,多数任务成本最多降低 30%。
Anthropic 发布 Claude Sonnet 5.5,这是 Claude 5.5 家族的第二款模型。官方称其为相对 Sonnet 5 的明显升级,运行速度提升超过 30%,大多数工作场景成本最多降低 30%。
Anthropic 宣布 Claude Sonnet 5.5 即日起在所有渠道上线,Claude Haiku 5.5 将在未来几周加入该模型家族。官方给出了进一步阅读链接 anthropic.com/claude-sonnet-…。
Anthropic 的自动化行为审计显示,Sonnet 5.5 在对齐与诚实度的大多数指标上优于或持平 Sonnet 5。它还是首个配备网络安全防护与回退机制的 Sonnet 模型,规格对齐其最强模型,日常软件开发不受影响。
Claude 官方账号表示 Sonnet 5.5 在設計方面颇有心得,能为用户界面增加精致度,并按模板生成几乎无需再编辑的幻灯片。
Claude Sonnet 5.5 在低或中等推理强度下,于多项基准测试中超过 Sonnet 5 的最佳成绩,成本约为其十分之一。该对比由 Claude 官方账号发布。
Anthropic 发布 Claude Sonnet 5.5,定价与 Sonnet 5 相同,但完成同样工作所需的 token 通常少得多。官方测试显示,其单任务成本比前代最多低 30%,输出生成速度提升超过 30%,是迄今最快的 Sonnet 模型。
Anthropic 发布 Claude Sonnet 5.5,在多项基准上较 Sonnet 5 提升,部分提升明显。它被定位为 Claude Opus 5.5 更快、成本更低的补充,擅长范围明确的日常任务、修 bug 以及制作文档、幻灯片和表格。原文未给出具体基准数值。
Anthropic 发布 Claude 5.5 系列的第二款模型 Claude Sonnet 5.5。官方称它是相对 Sonnet 5 的一次明确升级,运行速度提升超过 30%,大多数工作场景的成本最多降低 30%。
官方给出速度与成本两项变化,读者可据此判断升级对现有调用成本的影响。
Simon Willison 提出 "Fable class models" 这一说法,用来指代一档模型:最早是 Claude Fable 5,如今包括 Claude Opus 5.5、GPT-Astra 6,GPT-5.6 Sol 或许也算。他未在推文中给出该档位的具体判定标准。
Claude Opus 5.5 被作者称为截止今天的世界最强模型,同时也是最便宜的模型。作者以 Claude Max Plan 20x 为例,称每月 $200 可消耗约 600 亿 Token。
Claude Opus 5.0 在一项任务中识别出 IP 共享路径后拒绝使用,理由是它将"不得针对其他外部系统"的指令理解为排除第三方服务。Fable 和 GPT-6 Astra 则直接拒绝了这些任务。
本期 Import AI 介绍了 Michael Levin 关于心智或为 Platonic 模式空间界面的论文,认为身体与机器只是这些模式进入物理世界的接口;Anthropic 的 Perry Dong 与 Chelsea Finn 提出机器人缺少类似 LLM 的后训练通用配方,并介绍了 EXPO(-FT) 算法。
Naive AI 发布开源模型 Naive-N0.5-Flash,权重与推理代码以 MIT 许可证开放,API 输入每百万 Token 0.6 元、输出每百万 2.6 元。
AITDK SEO Extension 作者用 Claude Opus 5.5 生成一分钟宣传视频,一次就通过,效果令其满意。他表示此前试过很多模型都不满意,项目因此一直拖延,昨晚用 Opus 5.5 才完成。
用户让 Opus 5.5 制作一段数据中心主题视频,结果超出其想象。该模型在获得参考视频以及自行调用或生成任意素材的权限后,展现出很强的视频生成能力。
Anthropic 的 Claude Sonnet 5.5 已在 AI Gateway 上线,模型标识为 anthropic/claude-sonnet-5.5。