OpenAI 发布 GPT-6.1 Sol,缓存输入价格降至每百万 tokens 0.10 美元
OpenAI 发布 GPT-6.1 Sol,主打让前沿智能更可负担,开发者可以更大规模地构建和运行应用。缓存输入价格为每百万 tokens 0.10 美元,比标准输入价格低 95%,比 GPT-6 Sol 的缓存输入价格低 50%。
OpenAI 发布 GPT-6.1 Sol,主打让前沿智能更可负担,开发者可以更大规模地构建和运行应用。缓存输入价格为每百万 tokens 0.10 美元,比标准输入价格低 95%,比 GPT-6 Sol 的缓存输入价格低 50%。
OpenAI 表示,GPT-6.1 Sol 在自家对齐评测中较 GPT-6 Sol 有明显改进,表现更接近 GPT-6 Astra。它在说明自身局限时更透明,在遵循用户意图和安全约束方面也更可靠。
OpenAI 宣布 GPT-6.1 Sol 发布,称其在编码、computer use 和复杂专业工作上相较 GPT-6 Sol 有显著升级。该模型在多项基准上接近 GPT-6 Astra,同时成本大幅更低。
OpenAI 发布 GPT-6.1 Sol,称其以 Astra 五分之一的成本提供接近 Astra 的智能水平,是目前同性能下最具成本效益的模型。原文未披露参数规模、上下文长度及具体定价。
OpenAI 9/22 上线 GPT-6 Sol 和 Luna,Sol 定价 $2/$10 MTok 约为 GPT-5.6 一半,DeepSWE 68.8%,Luna 定价 $0.10/$0.50 MTok、单任务成本约 Sol 的 1/5。
Anthropic 的 Sonnet 5.5 性能逼近 Opus,价格仅为其一半。多位 AI 领袖继续就自我改进型 AI 发出警告,另有一个快速测试可帮助用户选择合适的 Claude 模型。AMD 以 82 亿美元收购 Fei-Fei Li 创办的 World Labs。
Anthropic 发布 Claude Sonnet 5.5,面向日常编程、代码修复与文档制作,官方称相比 Sonnet 5 输出速度提升超过 30%,相同任务消耗更少 Token。
Qdrant 的 /4 Nano 和 Zero 专门训练用于生成与 Stella 文档嵌入兼容的向量,因此无需重建文档索引即可在两者间切换,权衡检索质量与查询延迟。其中 Zero 极其轻量,Nano 是小型 Transformer,检索质量更接近 Stella。
Notion 宣布 Claude Sonnet 5.5 已在 Notion 中上线。Anthropic 介绍称,Claude Sonnet 5.5 是 Claude 5.5 家族的第二款模型,相比 Sonnet 5 速度提升超过 30%,多数工作场景成本最多降低 30%。
Anthropic 发布 Claude Sonnet 5.5,距 Opus 5.5 发布不到一周。在 Terminal-Bench 4.0 编程评测中,Sonnet 5.5 的 Max 档从上一代 Sonnet 5 的 10.3% 提升到 70.6%。
梳理了 Sonnet 5.5 在编程与知识工作评测上的具体提升幅度、推理档位差异和官方迁移建议,便于对照选型。
Anthropic 的 Opus 5.5 靠纯代码生成品牌宣传片、像素动画,还能操控电脑画图,与 GPT-6 的 Sol 和 Luna 同周发布后,热度持续一周不退。
Qdrant 发布 Constella 研究预览,这是一组围绕 400M 参数英文嵌入模型 Stella 构建的模型家族,文档向量由 Stella 编码,查询可由 Zero、Nano 或 Stella 本身编码,均搜索同一个 Qdrant 集合,因此查询编码器可按请求热插拔,无需重新嵌入。
ElevenLabs 推出 Eleven v4 和 Eleven v4 Turbo 两款语音模型,官方称是迄今速度最快、情感表现最强的语音模型,并在 Artificial Analysis 排名第一。作者 Orange AI 认为 TTS 模型竞争已接近尾声,视频游戏领域的价值更高,算法资源顾不上 TTS。
Anthropic 发布 Sonnet 5.5,称其能力几乎与 Opus 5.5 相当,价格只要一半,同时 Haiku 5.5 也在路上。
Claude 发布 Sonnet 5 与 Sonnet 5.5 的弹跳球物理测试对比,两者使用来自 @forwardeditor 的同一提示词生成。结果以视频形式在 Twitter 展示,该帖获得 234 次点赞和约 10 万次浏览。
Anthropic 的 Claude 账号发帖询问用户正在用 Sonnet 5.5 探索什么,该帖获得 179 个点赞、44 条回复和 52626 次浏览。帖子未披露 Sonnet 5.5 的任何新功能、参数或发布信息。
Claude 官方账号展示了一组对比:给 Sonnet 5 与 Sonnet 5.5 同一个提示词,分别用 JavaScript 生成不到一分钟讲完恐龙史的动画,由 @kevin_t_ngo 创作。该演示发布在 Twitter 上,获得 693 个点赞、23 次转发和约 28 万次浏览。
Claude 官方分享了一批 Claude Sonnet 5.5 的早期实验,其中 @_re_pete 用 Sonnet 5 与 Sonnet 5.5 分别制作秋叶模拟器进行对比。该展示在 X 上获得 7943 次点赞、746719 次浏览。
Claude Haiku 5.5 将在未来几周推出,补齐 Claude 模型家族。该消息由 Mike Krieger 发布,未披露参数规模、上下文窗口或具体上线日期。
Anthropic 发布 Claude Sonnet 5.5,这是 Claude 5.5 家族的第二款模型。相比 Sonnet 5,它运行速度快 30% 以上,大多数工作场景成本最多降低 30%。
Anthropic 发布 Claude Sonnet 5.5,是 Claude 5.5 系列的第二款模型。官方称其在 Claude Code 中让用户完成的任务量比 Sonnet 5 多约 30%,多数工作场景下运行速度快 30% 以上、成本最多降低 30%。作者举例称,该模型用工具调用完成耙一码院子落叶的任务,比 Sonnet 5 快 24 秒、少用 6K token。
Anthropic 推出 Claude Sonnet 5.5,这是 Claude 5.5 家族的第二款模型。相比 Sonnet 5,它运行速度提升超过 30%,大多数工作场景成本降低最多 30%。Alex Albert 评价其写作清晰、迭代体验好,能力较 Sonnet 5 有明显跃升。
Claude 推出 Claude 5.5 家族第二款模型 Claude Sonnet 5.5,相比 Sonnet 5 运行速度快 30% 以上,多数任务的成本最多降低 30%。AI SDK 表示可以在 AI SDK 中使用 Claude Sonnet 5.5。
Claude Sonnet 5.5 已在 v0 上线,用户可通过 v0.app/?sonnet55 试用。据 Anthropic 介绍,它是 Claude 5.5 家族的第二款模型,相比 Sonnet 5 是明显升级,运行速度提升超过 30%,大多数任务成本最多降低 30%。
Anthropic 宣布 Claude Sonnet 5.5 正式可用,称其为 Claude 5.5 家族的第二个模型。相较 Sonnet 5,它运行速度提升超过 30%,多数任务的成本最多降低 30%。
Anthropic 官方给出 Sonnet 5.5 的提速与降价幅度,读者可据此判断既有工作流的替换成本。
Anthropic 宣布 Claude Sonnet 5.5 即日起在所有渠道上线,Claude Haiku 5.5 将在未来几周加入该模型家族。官方给出了进一步阅读链接 anthropic.com/claude-sonnet-…。
Anthropic 的自动化行为审计显示,Sonnet 5.5 在对齐与诚实度的大多数指标上优于或持平 Sonnet 5。它还是首个配备网络安全防护与回退机制的 Sonnet 模型,规格对齐其最强模型,日常软件开发不受影响。
Claude 官方账号表示 Sonnet 5.5 在設計方面颇有心得,能为用户界面增加精致度,并按模板生成几乎无需再编辑的幻灯片。
Claude Sonnet 5.5 在低或中等推理强度下,于多项基准测试中超过 Sonnet 5 的最佳成绩,成本约为其十分之一。该对比由 Claude 官方账号发布。
Anthropic 发布 Claude Sonnet 5.5,定价与 Sonnet 5 相同,但完成同样工作所需的 token 通常少得多。官方测试显示,其单任务成本比前代最多低 30%,输出生成速度提升超过 30%,是迄今最快的 Sonnet 模型。
Anthropic 发布 Claude Sonnet 5.5,在多项基准上优于 Sonnet 5,部分提升明显。官方称它是 Claude Opus 5.5 更快、成本更低的补充,最擅长范围明确的日常任务、修复 bug 以及制作文档、幻灯片和表格。
Anthropic 发布 Claude Sonnet 5.5,这是 Claude 5.5 家族的第二款模型。官方称其相较 Sonnet 5 有明显升级,运行速度提升超过 30%,大多数工作的成本最高降低 30%。
PrunaAI 的 P-Video-2-Pro 已上线 Replicate。该模型基于 MiniMax H3,其 Quality 与 Speed 两个版本在 Design Arena 图生视频榜单以 1325 Elo 并列第二,Quality 生成耗时 8.0 秒,Speed 为 4.5 秒。
ElevenLabs 发布 Eleven v4 和 Eleven v4 Turbo,称是迄今最快、最具情感表现力的语音模型,并在 Artificial Analysis 排名第一。Justine Moore 体验后表示,该模型采用新架构,语音更真实可控,可以同时导演角色的表演和其周围的声景,还提供了廉价麦克风等语音效果。
Kling 4.0 将于今年 10 月发布,Kling 4.0 Flash 已面向 Ultra 年付订阅用户上线。
Gemini Audio 推出最新 Live 与 TTS 模型并发布周边礼品庆祝。原文未披露模型版本号、参数规模、benchmark 分数或可用性信息。
斯坦福大学与 NVIDIA Research 联合发布 Contrastive Language Models(CLM),一类用对比学习目标训练的 System One 决策模型,首发版本 CLM-8B 以冻结的 Qwen3-8B 为骨干,只训练 2000 万参数的 MLP 投影头,检查点仅 75MB。
ElevenLabs 发布新一代表现力语音生成模型,官方称其为最新研究成果的集成,面向角色表演和对话式智能体等强调表达效果的场景。模型已在 ElevenAgents、ElevenCreative 和 ElevenAPI 上线,地址为 elevenlabs.io/v4。
ElevenLabs 发布 Eleven v4 和 Eleven v4 Turbo 两款语音模型,称是其迄今速度最快、情感表现最强的语音模型。官方表示两者在 Artificial Analysis 排名中位列第一。
NaiveAI 以 MIT 许可证开放 Naive-N0.5-Flash 的模型权重与推理代码,该模型面向编程与 AI 研发,采用 MoE 架构,总参数 309B、激活约 15.5B,原生支持 100 万 Token 上下文,FP8 权重约占 315GB。