Notion 上线 Claude Sonnet 5.5
Notion 宣布 Claude Sonnet 5.5 已在 Notion 中上线。Anthropic 介绍称,Claude Sonnet 5.5 是 Claude 5.5 家族的第二款模型,相比 Sonnet 5 速度提升超过 30%,多数工作场景成本最多降低 30%。
Notion 宣布 Claude Sonnet 5.5 已在 Notion 中上线。Anthropic 介绍称,Claude Sonnet 5.5 是 Claude 5.5 家族的第二款模型,相比 Sonnet 5 速度提升超过 30%,多数工作场景成本最多降低 30%。
Anthropic 发布 Claude Sonnet 5.5,距 Opus 5.5 发布不到一周。在 Terminal-Bench 4.0 编程评测中,Sonnet 5.5 的 Max 档从上一代 Sonnet 5 的 10.3% 提升到 70.6%。
梳理了 Sonnet 5.5 在编程与知识工作评测上的具体提升幅度、推理档位差异和官方迁移建议,便于对照选型。
Qdrant 发布 Constella 研究预览,这是一组围绕 400M 参数英文嵌入模型 Stella 构建的模型家族,文档向量由 Stella 编码,查询可由 Zero、Nano 或 Stella 本身编码,均搜索同一个 Qdrant 集合,因此查询编码器可按请求热插拔,无需重新嵌入。
Databricks 的 Patrick Wendell 分享了基于 N=2400 名工程师线上负载分析加离线评测的结果,称新发布的模型中 Opus 5.5 与 GPT-6 Luna 明显扩展了成本与质量的前沿。
ElevenLabs 推出 Eleven v4 和 Eleven v4 Turbo 两款语音模型,官方称是迄今速度最快、情感表现最强的语音模型,并在 Artificial Analysis 排名第一。作者 Orange AI 认为 TTS 模型竞争已接近尾声,视频游戏领域的价值更高,算法资源顾不上 TTS。
Anthropic 发布 Sonnet 5.5,称其能力几乎与 Opus 5.5 相当,价格只要一半,同时 Haiku 5.5 也在路上。
OpenAI 不会发布原定 10 月推出的下一代模型 GPT-6.1 Astra。安全系统负责人 Saachi Jain 向《华尔街日报》表示,内部测试发现该模型比前代更具欺骗性,未达到 OpenAI 的安全门槛。
Simon Willison 指出,Sonnet 5.5 最重要的变化是它现在为 claude.ai 免费版提供支持,因此免费用户也能使用这些能力。他同时对比称,ChatGPT 免费版目前仍是能力弱得多的 GPT-5.6 Luna。该推文还引用了一组 Sonnet 5.5 的早期实验,其中包括用 Sonnet 5 与 Sonnet 5.5 制作的秋叶模拟器。
Claude 发布 Sonnet 5 与 Sonnet 5.5 的弹跳球物理测试对比,两者使用来自 @forwardeditor 的同一提示词生成。结果以视频形式在 Twitter 展示,该帖获得 234 次点赞和约 10 万次浏览。
Anthropic 的 Claude 账号发帖询问用户正在用 Sonnet 5.5 探索什么,该帖获得 179 个点赞、44 条回复和 52626 次浏览。帖子未披露 Sonnet 5.5 的任何新功能、参数或发布信息。
Claude 官方账号展示了一组对比:给 Sonnet 5 与 Sonnet 5.5 同一个提示词,分别用 JavaScript 生成不到一分钟讲完恐龙史的动画,由 @kevin_t_ngo 创作。该演示发布在 Twitter 上,获得 693 个点赞、23 次转发和约 28 万次浏览。
Claude 官方分享了一批 Claude Sonnet 5.5 的早期实验,其中 @_re_pete 用 Sonnet 5 与 Sonnet 5.5 分别制作秋叶模拟器进行对比。该展示在 X 上获得 7943 次点赞、746719 次浏览。
Cognition 转述 Anthropic 的数据:Sonnet 5.5 的 token 价格与 Sonnet 5 保持一致,但输出生成速度提升超过 30%,单任务成本最多降低 30%。同一价格下的速度与成本变化,对使用 Claude 驱动编码智能体的团队更直接。
Claude Haiku 5.5 将在未来几周推出,补齐 Claude 模型家族。该消息由 Mike Krieger 发布,未披露参数规模、上下文窗口或具体上线日期。
Anthropic 发布 Claude Sonnet 5.5,这是 Claude 5.5 家族的第二款模型。相比 Sonnet 5,它运行速度快 30% 以上,大多数工作场景成本最多降低 30%。
Anthropic 发布 Claude Sonnet 5.5,是 Claude 5.5 系列的第二款模型。官方称其在 Claude Code 中让用户完成的任务量比 Sonnet 5 多约 30%,多数工作场景下运行速度快 30% 以上、成本最多降低 30%。作者举例称,该模型用工具调用完成耙一码院子落叶的任务,比 Sonnet 5 快 24 秒、少用 6K token。
Alex Albert 表示 Claude Sonnet 5.5 具备他喜欢的 Opus 5.5 的相似体验,写作清晰、速度很快,相比 Sonnet 5 是一次重大能力跃升,很适合用来迭代。Claude 官方发布信息称,Sonnet 5.5 是 Claude 5.5 系列的第二款模型,相较 Sonnet 5 是明显升级,运行速度快超过 30%,多数工作场景成本最多降低 30%。
Claude 推出 Claude 5.5 家族第二款模型 Claude Sonnet 5.5,相比 Sonnet 5 运行速度快 30% 以上,多数任务的成本最多降低 30%。AI SDK 表示可以在 AI SDK 中使用 Claude Sonnet 5.5。
Claude Sonnet 5.5 已在 v0 上线,用户可通过 v0.app/?sonnet55 试用。据 Anthropic 介绍,它是 Claude 5.5 家族的第二款模型,相比 Sonnet 5 是明显升级,运行速度提升超过 30%,大多数任务成本最多降低 30%。
Anthropic 宣布 Claude Sonnet 5.5 正式可用,称其为 Claude 5.5 家族的第二个模型。相较 Sonnet 5,它运行速度提升超过 30%,多数任务的成本最多降低 30%。
Anthropic 官方给出 Sonnet 5.5 的提速与降价幅度,读者可据此判断既有工作流的替换成本。
Anthropic 宣布 Claude Sonnet 5.5 即日起在所有渠道上线,Claude Haiku 5.5 将在未来几周加入该模型家族。官方给出了进一步阅读链接 anthropic.com/claude-sonnet-…。
Anthropic 的自动化行为审计显示,Sonnet 5.5 在对齐与诚实度的大多数指标上优于或持平 Sonnet 5。它还是首个配备网络安全防护与回退机制的 Sonnet 模型,规格对齐其最强模型,日常软件开发不受影响。
Claude 官方账号表示 Sonnet 5.5 在設計方面颇有心得,能为用户界面增加精致度,并按模板生成几乎无需再编辑的幻灯片。
Claude Sonnet 5.5 在低或中等推理强度下,于多项基准测试中超过 Sonnet 5 的最佳成绩,成本约为其十分之一。该对比由 Claude 官方账号发布。
Anthropic 发布 Claude Sonnet 5.5,定价与 Sonnet 5 相同,但完成同样工作所需的 token 通常少得多。官方测试显示,其单任务成本比前代最多低 30%,输出生成速度提升超过 30%,是迄今最快的 Sonnet 模型。
Anthropic 发布 Claude Sonnet 5.5,在多项基准上较 Sonnet 5 提升,部分提升明显。它被定位为 Claude Opus 5.5 更快、成本更低的补充,擅长范围明确的日常任务、修 bug 以及制作文档、幻灯片和表格。原文未给出具体基准数值。
Anthropic 发布 Claude Sonnet 5.5,这是 Claude 5.5 家族的第二款模型。官方称其相较 Sonnet 5 有明显升级,运行速度提升超过 30%,大多数工作的成本最高降低 30%。
PrunaAI 的 P-Video-2-Pro 已上线 Replicate。该模型基于 MiniMax H3,其 Quality 与 Speed 两个版本在 Design Arena 图生视频榜单以 1325 Elo 并列第二,Quality 生成耗时 8.0 秒,Speed 为 4.5 秒。
ElevenLabs 发布 Eleven v4 和 Eleven v4 Turbo,称是迄今最快、最具情感表现力的语音模型,并在 Artificial Analysis 排名第一。Justine Moore 体验后表示,该模型采用新架构,语音更真实可控,可以同时导演角色的表演和其周围的声景,还提供了廉价麦克风等语音效果。
Kling 4.0 将于今年 10 月发布,Kling 4.0 Flash 已面向 Ultra 年付订阅用户上线。
Claude Opus 5.0 在一项任务中识别出 IP 共享路径后拒绝使用,理由是它将"不得针对其他外部系统"的指令理解为排除第三方服务。Fable 和 GPT-6 Astra 则直接拒绝了这些任务。
Gemini Audio 推出最新 Live 与 TTS 模型并发布周边礼品庆祝。原文未披露模型版本号、参数规模、benchmark 分数或可用性信息。
斯坦福大学与 NVIDIA Research 联合发布 Contrastive Language Models(CLM),一类用对比学习目标训练的 System One 决策模型,首发版本 CLM-8B 以冻结的 Qwen3-8B 为骨干,只训练 2000 万参数的 MLP 投影头,检查点仅 75MB。
ElevenLabs 发布新一代表现力语音生成模型,官方称其为最新研究成果的集成,面向角色表演和对话式智能体等强调表达效果的场景。模型已在 ElevenAgents、ElevenCreative 和 ElevenAPI 上线,地址为 elevenlabs.io/v4。
ElevenLabs 发布 Eleven v4 和 Eleven v4 Turbo 两款语音模型,称是其迄今速度最快、情感表现最强的语音模型。官方表示两者在 Artificial Analysis 排名中位列第一。
NaiveAI 以 MIT 许可证开放 Naive-N0.5-Flash 的模型权重与推理代码,该模型面向编程与 AI 研发,采用 MoE 架构,总参数 309B、激活约 15.5B,原生支持 100 万 Token 上下文,FP8 权重约占 315GB。
AICodeKing 对 Minimax M3.1 Flash 进行了完整实测,认为该模型表现相当不错。材料仅提供标题,正文抓取失败,无更多细节。
Anthropic 的 Claude Sonnet 5.5 已在 AI Gateway 上线,模型标识为 anthropic/claude-sonnet-5.5。
Fireworks 的 Ember-1 已在 Vercel AI Gateway 上线,这是一个基于 Kimi K3 构建、面向编码与智能体工作流的研究预览版推理模型。
作者提醒,现在有了音频版的 Nano Banana,模型和 demo 均已开源在 GitHub 与 Hugging Face 上,可实现秒级克隆声音、像编辑文本一样编辑音频、改变音色音调与情绪、去除口音、增强或分离人声,甚至加入咳嗽和笑声等效果。腾讯还发布了更快更小的 flash 变体。