Google Gemini 4 "Carbon" 模型据称编码性能追平 Anthropic Opus 5.5
据 Business Insider 看到的内部文件与聊天记录,Google 正在测试 Argon、Barium、Carbon 三个 Gemini 4 变体,其中 Carbon 已部署在内部编码平台 Jetski 上,被认为在编程任务上强于 Argon,有员工将其比作 Anthropic 最强的编码模型 Opus 5.5,但仍需更多测试。
据 Business Insider 看到的内部文件与聊天记录,Google 正在测试 Argon、Barium、Carbon 三个 Gemini 4 变体,其中 Carbon 已部署在内部编码平台 Jetski 上,被认为在编程任务上强于 Argon,有员工将其比作 Anthropic 最强的编码模型 Opus 5.5,但仍需更多测试。
Google 内部正在测试新模型 Carbon,部署在内部 AI 编程工具 Jetski 上,有员工称其编码能力“感觉像 Opus 5.5”。Carbon 是在 9 月 30 日发布的 Gemini 4 Argon(内部版本 Barium-B)之后训练出的新版本,将作为 Argon 升级还是独立发布尚不清楚。
Anthropic 发布小型模型 Claude Haiku 5.5,平均价格比 Haiku 4.5 低约 75%,10 万 token 以内的提示词最高降价 90%,同时 Sonnet 5.5 的缓存读取价格减半。
针对有人不理解为何大家对 Opus 生成的视频如此着迷,这条推文提出了这一疑问,并附上视频引发讨论。原文未披露 Opus 的版本、参数或视频生成的具体能力细节。
Notion 宣布其平台已可调用 Claude Haiku 5.5。引用 Anthropic 的介绍,Haiku 5.5 是其发布的最便宜、最快且能力最强的小模型,平均运行成本比 Claude Haiku 4.5 低约 75%。
Anthropic 的 Claude Haiku 5.5 已在 OpenRouter 上线。OpenRouter 称这是首个支持 reasoning efforts 的 Haiku 模型,价格比上一代便宜约 75%,速度实测 100+ TPS,基准测试中能力也有明显提升,可通过 openrouter.ai/anthropic/clau… 使用。
Anthropic 发布 Haiku 5.5,作者对比其与几款中国竞品的价格和测试评分:价格上比 DeepSeek-V4.1 flash 和智谱 GLM 5.3 flash 都便宜。在 Terminal Bench 4.0 上,作者称其分数比 GLM 5.3 flash 高一分,与另一竞品相同,比其他两个更高。
Simon Willison 发布了一篇关于 Claude Haiku 5.5 定价的笔记,标题中同时提到 Pelicans,附有 simonwillison.net 的链接。材料仅有推文摘要,未提供具体定价数字或分析内容。
Haiku 5.5 在绘制骑自行车的鹈鹕上明显优于近一年前发布、成本贵 10 倍的 Claude Haiku 4.5。作者同时贴出了 Haiku 4.5 的生成结果作对比。
Anthropic 发布 Claude Haiku 5.5,称其为该公司迄今最便宜、最快、能力最强的小模型。该模型相较上一代有大幅提升,在多项基准上超过 OpenAI 的同类模型 GPT-6 Luna,起售价为每百万输入 token 0.10 美元,运行成本比 Haiku 4.5 低约 75%,与 Luna 持平。
Anthropic 发布 Claude Haiku 5.5,称其是目前最便宜、最快且能力最强的小模型。官方表示其运行成本平均比 Claude Haiku 4.5 低约 75%。
Claude Haiku 5.5 在编码、计算机使用和知识工作三类任务上较 Haiku 4.5 实现显著提升。该消息未披露具体参数规模、benchmark 分数或可用性细节。
Anthropic 发布 Haiku 5.5,这是其首个带可调 effort 设置的 Haiku 模型,用户可按任务自行选择偏向成本还是智能。原文未披露具体版本参数与定价信息。
Claude Haiku 5.5 在 10 万 token 以下任务上性价比尤为突出,这类任务占前代 Haiku 模型约 90% 的请求量。该说法来自 Claude 官方账号,未披露具体价格或 benchmark 数据。
Anthropic 宣布 Haiku 5.5 现已在所有平台上线,包括 Amazon Web Services、Google Cloud 和 Microsoft Azure。官方给出详情链接 anthropic.com/claude-haiku-5。
Anthropic 将 Claude Sonnet 5.5 的缓存读取价格减半,降至每百万 token 0.10 美元。官方称这一调整使 Sonnet 5.5 在大多数长时任务上的运行成本降低约 20%。
Claude Haiku 5.5 的 benchmark 全面领先 GPT-6 Luna,OpenRouter 观测到的 token 输出速度也是 2 倍。Anthropic 官方称 Claude Haiku 5.5 是迄今最便宜、最快、最强的小模型,运行成本比 Claude Haiku 4.5 低约 75%。
Anthropic 发布 Claude Haiku 5.5,10 万 Token 以内请求每百万 Token 输入 0.1 美元、输出 0.5 美元,比 Haiku 4.5 便宜 90%,官方估算平均运行成本降约 75%。
宝玉指出 Haiku 5.5 的价格看似很低,但上下文一旦超过 100K,价格会上涨 5 倍,这一细节在价格页被隐藏起来。他引用其他用户的说法称这是阶梯定价,对比之下 GPT 的分界线是 272K,并认为这种设计相当于面向 Benchmark 的特化优化。
Anthropic 发布 Claude Haiku 5.5,官方称这是其推出的最便宜、最快、能力最强的小模型,平均运行成本比 Claude Haiku 4.5 低约 75%。该模型现已加入 Agent Arena,可在其中使用网页搜索、文件系统和终端工具完成长流程智能体任务,成绩尚未公布;同时也在 Code Arena 的 WebDev、Text、Document 和 Vision 板块上线。
Claude Haiku 5.5 在 Code Arena 得分 1587 分,比 Haiku 4.5 的 1330 分提升 257 分,且各分类均有明显进步。相关榜单可在 Code Arena: WebDev(arena.ai/leaderboard/co…)查看。
Arena.ai 公布 Claude Haiku 5.5 (High) 在 Code Arena: WebDev 的真实评测结果,首秀以 1587 分排在第 30 位,略在帕累托前沿之外,但仍然具备很强的成本效率。
Anthropic 在 X 上宣布推出最新模型 Claude Haiku 5.5。该帖未披露参数、能力指标或开放范围等细节。
Genspark 宣布 Claude Haiku 5.5 已在其 AI Chat、Code Agent 和 Claw 中上线,并称这是 Anthropic 目前最便宜、最快、能力最强的小模型。Anthropic 官方介绍称,Claude Haiku 5.5 平均运行成本比 Claude Haiku 4.5 低约 75%。
Claude haiku 5.5 的定价被吐槽不合理:上下文超过 100k 后价格直接变为 5 倍。该帖引发 38 条讨论、146 次点赞,浏览量达 57068。
Anthropic 发布 Claude Haiku 5.5,OSWorld 2.1 评测从上一代 15.7% 提升到 72.4%,平均运行成本下降约 75%,并首次支持可调节推理强度的 Adaptive Thinking 与 100 万 Token 上下文。
Anthropic 于 10 月 7 日发布 Claude Haiku 5.5,面向摘要、上下文压缩、数据库查询和分类等高频任务,是首款支持可调推理强度的 Haiku 模型,提示词不超过 10 万 Token 时每百万输入、输出 Token 分别为 0.10 美元和 0.50 美元,当前未开放模型权重。
Anthropic 发布 Claude Haiku 5.5,这是 Haiku 系列约一年来的首次更新,定价与 OpenAI 的 GPT-6 Luna 持平,同日 Sonnet 5.5 缓存读取价格减半并推出订阅 API 额度。
汇总了 Haiku 5.5 的定价、第三方评测与 token 消耗代价,读者可据此判断小型模型在智能体工作流中的实际位置。
OpenAI 宣布 GPT-6 面向全球推送,付费用户先行,10 月 8 日起免费用户也能使用,正式取代 GPT-5.6 Sol 和 Luna,并带来可自动生成图表、按钮、表单的 Intelligent UI。
Anthropic 的 Haiku 5.5 定价低于 DeepSeek-V4.1 flash 和智谱 GLM 5.3 flash,在 Terminal Bench 4.0 上比 GLM 5.3 flash 高一分,与其他两个中国竞品相当或更高。Anthropic 还向每个 Max 和 Team 用户赠送对应额度的 API 金额,该 API 可在任何支持输入 API 的产品中使用。
Mistral 发布原生多模态 MoE 模型 Mistral Large 4(昵称“Le Chonk”)公开预览,总参数 1 万亿、激活约 490 亿,可通过 Mistral Studio API 试用,权重计划月底发布。
Haiku 5.5 在 Browser Use Bench v2.1 上跑出与 Luna 相同的性能,但价格是后者的 2.8 倍。Haiku 在上下文超过 100k 后价格再涨 5 倍,且缓存 token 也计入其中;而 BU Bench 2.1 多为极长时程任务,会频繁触及该定价档位。
Claude Haiku 5.5 已在 Devin 上线,在 FrontierCode 1.1 上得分 58.4%,超过 Sonnet 5,且每任务成本约为其八分之一。它还可作为 Fusion 中的辅助模型,搭配 Opus 5.5 作为 Lead 在 Devin Desktop 和 CLI 中使用。
Anthropic 发布快速低价模型 Claude Haiku 5.5,价格与 OpenAI 上月发布的 GPT-6 Luna 完全一致,为每百万 token 输入 0.10 美元。
Claude Haiku 5.5 在编码、computer use 和知识工作方面相比 Haiku 4.5 有显著提升,同时速度更快、价格便宜 75%。作者提到 Haiku 4.5 发布于 2025 年 10 月 15 日,两代间隔不到一年。
AWS 宣布 Claude Haiku 5.5 已在 Amazon Bedrock 和 Claude Platform on AWS 上线。据 Anthropic 介绍,它是 Claude 5.5 家族中速度最快、效率最高的模型,面向子智能体和高并发成本敏感场景,多数任务成本比 Claude Haiku 4.5 低约 75%。
Anthropic 发布 Claude Haiku 5.5,加入 5.5 系列,官方称其为迄今最便宜、最快且能力最强的小模型。它在运行时平均成本约为 Claude Haiku 4.5 的 25%,即低约 75%。Mike Krieger 表示 Opus 负责重推理,Haiku 承担高吞吐工作。
AI SDK 宣布支持使用 Claude Haiku 5.5。其引用的 Anthropic 介绍称,Claude Haiku 5.5 是该方发布过的最便宜、最快且能力最强的小模型,运行成本平均比 Claude Haiku 4.5 低约 75%。
Vercel AI Gateway 现已上线 Anthropic 的 Claude Haiku 5.5,这一版本面向摘要、上下文压缩、数据库查询和分类等高频、成本敏感任务,也可作为子智能体配合更大的 Claude 模型处理编码工作。
Agent Arena 按解决跨领域实际任务的智能体能力对模型排名,美国实验室在所有领域领先:Anthropic 模型在 Code、Work、Chat 均居第一,OpenAI 的 GPT 6 Astra(Max)在三个类别都进入前四,Code 第 2、Work 与 Chat 均第 4。