跳到正文

#模型发布

今日 19 条
9月30日周三
  1. OpenAI(@OpenAI)AI 评估 · 73/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 发布 GPT-6.1 Sol,缓存输入价格降至每百万 tokens 0.10 美元

    OpenAI 发布 GPT-6.1 Sol,主打让前沿智能更可负担,开发者可以更大规模地构建和运行应用。缓存输入价格为每百万 tokens 0.10 美元,比标准输入价格低 95%,比 GPT-6 Sol 的缓存输入价格低 50%。

  2. OpenAI(@OpenAI)AI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 称 GPT-6.1 Sol 对齐评测表现优于 GPT-6 Sol

    OpenAI 表示,GPT-6.1 Sol 在自家对齐评测中较 GPT-6 Sol 有明显改进,表现更接近 GPT-6 Astra。它在说明自身局限时更透明,在遵循用户意图和安全约束方面也更可靠。

  3. OpenAI(@OpenAI)AI 评估 · 69/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 发布 GPT-6.1 Sol,多项基准接近 GPT-6 Astra 且成本更低

    OpenAI 宣布 GPT-6.1 Sol 发布,称其在编码、computer use 和复杂专业工作上相较 GPT-6 Sol 有显著升级。该模型在多项基准上接近 GPT-6 Astra,同时成本大幅更低。

  4. OpenAI(@OpenAI)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6.1 Sol 发布:接近 Astra 的智能水平,价格仅为其五分之一

    OpenAI 发布 GPT-6.1 Sol,称其以 Astra 五分之一的成本提供接近 Astra 的智能水平,是目前同性能下最具成本效益的模型。原文未披露参数规模、上下文长度及具体定价。

9月29日周二
  1. 印记中文AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI周刊 #102:OpenAI 发布 GPT-6 Sol/Luna,Anthropic 发布 Claude Opus 5.5

    OpenAI 9/22 上线 GPT-6 Sol 和 Luna,Sol 定价 $2/$10 MTok 约为 GPT-5.6 一半,DeepSWE 68.8%,Luna 定价 $0.10/$0.50 MTok、单任务成本约 Sol 的 1/5。

  2. The Rundown AI(@TheRundownAI)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    今日 AI 要闻:Anthropic Sonnet 5.5 以半价逼近 Opus,AMD 82 亿美元收购 Fei-Fei Li 的 World Labs

    Anthropic 的 Sonnet 5.5 性能逼近 Opus,价格仅为其一半。多位 AI 领袖继续就自我改进型 AI 发出警告,另有一个快速测试可帮助用户选择合适的 Claude 模型。AMD 以 82 亿美元收购 Fei-Fei Li 创办的 World Labs。

  3. 机器之心SOTA模型AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Sonnet 5.5,IQuest 开源 320B MoE 模型 IQuest-Q1

    Anthropic 发布 Claude Sonnet 5.5,面向日常编程、代码修复与文档制作,官方称相比 Sonnet 5 输出速度提升超过 30%,相同任务消耗更少 Token。

  4. Qdrant(@qdrant_engine)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qdrant 推出 /4 Nano 和 Zero,向量兼容 Stella 文档嵌入

    Qdrant 的 /4 Nano 和 Zero 专门训练用于生成与 Stella 文档嵌入兼容的向量,因此无需重建文档索引即可在两者间切换,权衡检索质量与查询延迟。其中 Zero 极其轻量,Nano 是小型 Transformer,检索质量更接近 Stella。

  5. Notion(@NotionHQ)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Notion 上线 Claude Sonnet 5.5

    Notion 宣布 Claude Sonnet 5.5 已在 Notion 中上线。Anthropic 介绍称,Claude Sonnet 5.5 是 Claude 5.5 家族的第二款模型,相比 Sonnet 5 速度提升超过 30%,多数工作场景成本最多降低 30%。

  6. 夕小瑶科技说AI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Sonnet 5.5,编程能力逼近 Opus 5.5

    Anthropic 发布 Claude Sonnet 5.5,距 Opus 5.5 发布不到一周。在 Terminal-Bench 4.0 编程评测中,Sonnet 5.5 的 Max 档从上一代 Sonnet 5 的 10.3% 提升到 70.6%。

    为什么值得看

    梳理了 Sonnet 5.5 在编程与知识工作评测上的具体提升幅度、推理档位差异和官方迁移建议,便于对照选型。

  7. 有机大橘子AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Opus 5.5:从大语言模型,到世界模型?

    Anthropic 的 Opus 5.5 靠纯代码生成品牌宣传片、像素动画,还能操控电脑画图,与 GPT-6 的 Sol 和 Luna 同周发布后,热度持续一周不退。

  8. QdrantAI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qdrant 发布 Constella 研究预览:无需重新嵌入即可切换查询模型

    Qdrant 发布 Constella 研究预览,这是一组围绕 400M 参数英文嵌入模型 Stella 构建的模型家族,文档向量由 Stella 编码,查询可由 Zero、Nano 或 Stella 本身编码,均搜索同一个 Qdrant 集合,因此查询编码器可按请求热插拔,无需重新嵌入。

  9. orange.ai(@oran_ge)AI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ElevenLabs 发布 Eleven v4 与 v4 Turbo 语音模型

    ElevenLabs 推出 Eleven v4 和 Eleven v4 Turbo 两款语音模型,官方称是迄今速度最快、情感表现最强的语音模型,并在 Artificial Analysis 排名第一。作者 Orange AI 认为 TTS 模型竞争已接近尾声,视频游戏领域的价值更高,算法资源顾不上 TTS。

  10. orange.ai(@oran_ge)AI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Sonnet 5.5,称性能接近 Opus 5.5 且价格减半

    Anthropic 发布 Sonnet 5.5,称其能力几乎与 Opus 5.5 相当,价格只要一半,同时 Haiku 5.5 也在路上。

  11. Claude(@claudeai)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sonnet 5.5 对比 Sonnet 5:同一提示词下的弹跳球物理测试

    Claude 发布 Sonnet 5 与 Sonnet 5.5 的弹跳球物理测试对比,两者使用来自 @forwardeditor 的同一提示词生成。结果以视频形式在 Twitter 展示,该帖获得 234 次点赞和约 10 万次浏览。

  12. Claude(@claudeai)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Sonnet 5.5 探索中,大家在用它做什么?

    Anthropic 的 Claude 账号发帖询问用户正在用 Sonnet 5.5 探索什么,该帖获得 179 个点赞、44 条回复和 52626 次浏览。帖子未披露 Sonnet 5.5 的任何新功能、参数或发布信息。

  13. Claude(@claudeai)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Sonnet 5 与 Sonnet 5.5 用同一提示词生成 JavaScript 恐龙史动画对比

    Claude 官方账号展示了一组对比:给 Sonnet 5 与 Sonnet 5.5 同一个提示词,分别用 JavaScript 生成不到一分钟讲完恐龙史的动画,由 @kevin_t_ngo 创作。该演示发布在 Twitter 上,获得 693 个点赞、23 次转发和约 28 万次浏览。

  14. Claude(@claudeai)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Sonnet 5.5 早期实验:用 Sonnet 5 与 5.5 对比生成秋叶模拟器

    Claude 官方分享了一批 Claude Sonnet 5.5 的早期实验,其中 @_re_pete 用 Sonnet 5 与 Sonnet 5.5 分别制作秋叶模拟器进行对比。该展示在 X 上获得 7943 次点赞、746719 次浏览。

  15. Mike Krieger(@mikeyk)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Haiku 5.5 将在未来几周补齐模型家族

    Claude Haiku 5.5 将在未来几周推出,补齐 Claude 模型家族。该消息由 Mike Krieger 发布,未披露参数规模、上下文窗口或具体上线日期。

  16. Mike Krieger(@mikeyk)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Sonnet 5.5,运行速度提升超 30%、成本最多降 30%

    Anthropic 发布 Claude Sonnet 5.5,这是 Claude 5.5 家族的第二款模型。相比 Sonnet 5,它运行速度快 30% 以上,大多数工作场景成本最多降低 30%。

  17. cat(@_catwu)AI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Sonnet 5.5,Claude Code 中任务完成量提升约 30%

    Anthropic 发布 Claude Sonnet 5.5,是 Claude 5.5 系列的第二款模型。官方称其在 Claude Code 中让用户完成的任务量比 Sonnet 5 多约 30%,多数工作场景下运行速度快 30% 以上、成本最多降低 30%。作者举例称,该模型用工具调用完成耙一码院子落叶的任务,比 Sonnet 5 快 24 秒、少用 6K token。

  18. Alex Albert(@alexalbert__)AI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Sonnet 5.5,速度提升超 30%、成本降低最多 30%

    Anthropic 推出 Claude Sonnet 5.5,这是 Claude 5.5 家族的第二款模型。相比 Sonnet 5,它运行速度提升超过 30%,大多数工作场景成本降低最多 30%。Alex Albert 评价其写作清晰、迭代体验好,能力较 Sonnet 5 有明显跃升。

  19. AI SDK(@aisdk)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI SDK 支持接入 Claude Sonnet 5.5

    Claude 推出 Claude 5.5 家族第二款模型 Claude Sonnet 5.5,相比 Sonnet 5 运行速度快 30% 以上,多数任务的成本最多降低 30%。AI SDK 表示可以在 AI SDK 中使用 Claude Sonnet 5.5。

  20. v0(@v0)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Sonnet 5.5 上线 v0,速度提升超 30% 且成本最多降低 30%

    Claude Sonnet 5.5 已在 v0 上线,用户可通过 v0.app/?sonnet55 试用。据 Anthropic 介绍,它是 Claude 5.5 家族的第二款模型,相比 Sonnet 5 是明显升级,运行速度提升超过 30%,大多数任务成本最多降低 30%。

  21. Anthropic(@AnthropicAI)AI 评估 · 76/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Sonnet 5.5

    Anthropic 宣布 Claude Sonnet 5.5 正式可用,称其为 Claude 5.5 家族的第二个模型。相较 Sonnet 5,它运行速度提升超过 30%,多数任务的成本最多降低 30%。

    为什么值得看

    Anthropic 官方给出 Sonnet 5.5 的提速与降价幅度,读者可据此判断既有工作流的替换成本。

  22. Claude(@claudeai)AI 评估 · 69/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Sonnet 5.5 全面上线,Haiku 5.5 将在未来几周加入

    Anthropic 宣布 Claude Sonnet 5.5 即日起在所有渠道上线,Claude Haiku 5.5 将在未来几周加入该模型家族。官方给出了进一步阅读链接 anthropic.com/claude-sonnet-…。

  23. Claude(@claudeai)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Sonnet 5.5 行为审计:对齐与诚实度多数指标持平或提升

    Anthropic 的自动化行为审计显示,Sonnet 5.5 在对齐与诚实度的大多数指标上优于或持平 Sonnet 5。它还是首个配备网络安全防护与回退机制的 Sonnet 模型,规格对齐其最强模型,日常软件开发不受影响。

  24. Claude(@claudeai)AI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 官方:Sonnet 5.5 擅长设计,可优化界面并生成少改动的幻灯片

    Claude 官方账号表示 Sonnet 5.5 在設計方面颇有心得,能为用户界面增加精致度,并按模板生成几乎无需再编辑的幻灯片。

  25. Claude(@claudeai)AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Sonnet 5.5 以低/中档推理力压 Sonnet 5 最佳成绩,成本仅约十分之一

    Claude Sonnet 5.5 在低或中等推理强度下,于多项基准测试中超过 Sonnet 5 的最佳成绩,成本约为其十分之一。该对比由 Claude 官方账号发布。

  26. Claude(@claudeai)AI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Sonnet 5.5,单任务成本最多降低 30%

    Anthropic 发布 Claude Sonnet 5.5,定价与 Sonnet 5 相同,但完成同样工作所需的 token 通常少得多。官方测试显示,其单任务成本比前代最多低 30%,输出生成速度提升超过 30%,是迄今最快的 Sonnet 模型。

  27. Claude(@claudeai)AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Sonnet 5.5,多项基准超过 Sonnet 5

    Anthropic 发布 Claude Sonnet 5.5,在多项基准上优于 Sonnet 5,部分提升明显。官方称它是 Claude Opus 5.5 更快、成本更低的补充,最擅长范围明确的日常任务、修复 bug 以及制作文档、幻灯片和表格。

  28. Claude(@claudeai)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Sonnet 5.5,速度提升超 30%、成本最高降低 30%

    Anthropic 发布 Claude Sonnet 5.5,这是 Claude 5.5 家族的第二款模型。官方称其相较 Sonnet 5 有明显升级,运行速度提升超过 30%,大多数工作的成本最高降低 30%。

  29. Replicate(@replicate)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    PrunaAI 的 P-Video-2-Pro 上线 Replicate,登 Design Arena 图生视频榜第二

    PrunaAI 的 P-Video-2-Pro 已上线 Replicate。该模型基于 MiniMax H3,其 Quality 与 Speed 两个版本在 Design Arena 图生视频榜单以 1325 Elo 并列第二,Quality 生成耗时 8.0 秒,Speed 为 4.5 秒。

  30. Justine Moore(@venturetwins)AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ElevenLabs 发布 Eleven v4 与 Eleven v4 Turbo 语音模型

    ElevenLabs 发布 Eleven v4 和 Eleven v4 Turbo,称是迄今最快、最具情感表现力的语音模型,并在 Artificial Analysis 排名第一。Justine Moore 体验后表示,该模型采用新架构,语音更真实可控,可以同时导演角色的表演和其周围的声景,还提供了廉价麦克风等语音效果。

9月28日周一
  1. Kling AI(@Kling_ai)AI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Kling 4.0 将于今年 10 月发布,Kling 4.0 Flash 已面向 Ultra 年付订阅用户上线

    Kling 4.0 将于今年 10 月发布,Kling 4.0 Flash 已面向 Ultra 年付订阅用户上线。

  2. Patrick Loeber(@patloeber)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini Audio 庆祝最新 Live 与 TTS 模型

    Gemini Audio 推出最新 Live 与 TTS 模型并发布周边礼品庆祝。原文未披露模型版本号、参数规模、benchmark 分数或可用性信息。

  3. 魔搭ModelScope社区AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    斯坦福与英伟达开源 CLM-8B:75MB 对比学习验证器刷新 DeepSWE 与 Terminal-Bench 2.1

    斯坦福大学与 NVIDIA Research 联合发布 Contrastive Language Models(CLM),一类用对比学习目标训练的 System One 决策模型,首发版本 CLM-8B 以冻结的 Qwen3-8B 为骨干,只训练 2000 万参数的 MLP 投影头,检查点仅 75MB。

  4. ElevenLabs(@elevenlabsio)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ElevenLabs 发布表现力语音生成新模型 v4

    ElevenLabs 发布新一代表现力语音生成模型,官方称其为最新研究成果的集成,面向角色表演和对话式智能体等强调表达效果的场景。模型已在 ElevenAgents、ElevenCreative 和 ElevenAPI 上线,地址为 elevenlabs.io/v4。

  5. ElevenLabs(@elevenlabsio)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ElevenLabs 发布 Eleven v4 与 Eleven v4 Turbo 语音模型

    ElevenLabs 发布 Eleven v4 和 Eleven v4 Turbo 两款语音模型,称是其迄今速度最快、情感表现最强的语音模型。官方表示两者在 Artificial Analysis 排名中位列第一。

  6. 机器之心SOTA模型AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NaiveAI开源Naive-N0.5-Flash编程模型,美团上线LongCat-2.5-Preview多模态模型

    NaiveAI 以 MIT 许可证开放 Naive-N0.5-Flash 的模型权重与推理代码,该模型面向编程与 AI 研发,采用 MoE 架构,总参数 309B、激活约 15.5B,原生支持 100 万 Token 上下文,FP8 权重约占 315GB。