Google DeepMind 发布 Gemini Robotics 2,展示机器人协同
Google DeepMind 发布 Gemini Robotics 2,并展示了机器人之间协同工作的能力。
Google DeepMind 发布 Gemini Robotics 2,并展示了机器人之间协同工作的能力。
Ideogram 发布 P-Image-Ideogram 图像模型家族,与 PrunaAI 联合开发,主打质量、速度与成本之间的帕累托最优权衡。该家族提供四种质量模式,支持原生 1K 和 2K 生成,每张图像起价 0.003 美元,现已在 API 及所有合作平台上线。
xAI 发布下一代语音模型 Grok Voice Think Fast 2.0,官方称其在智能水平、转写准确率和对话能力上均有提升。相关介绍见 x.ai/news/grok-voic…。
xAI 发布 Grok Voice Think Fast 2.0,专为真实世界语音智能体打造,可在嘈杂环境中清晰收音,能对复杂工作流进行推理,对话听起来也更自然。
v0 现已支持使用开放权重模型,首个接入的是 Kimi K3,可在 v0.app/?kimi3 试用。
Google DeepMind 发布新一代音乐生成模型 Lyria 3.5,并在 Google Flow Music 中上线。官方称该模型在音乐性、歌词和人声质量上均有提升,包括更丰富复杂的旋律结构、提示词遵循与结构感知更好的歌词、更具情感表现力和发音更准的人声,同时可更便捷地控制输出的节奏与时长。
Jina AI 推出 jina-reranker-v3.5,保持 0.6B 参数规模和 LBNL 列表式架构,专门解决垂直领域适配、结构化记录逻辑识别和长列表显存爆炸三大工程痛点。
Ideogram 发布 Ideogram 4.0,一个 9.3B 参数的开源权重 Diffusion Transformer 图像模型,称其在 LMArena 和 Design Arena 上超过所有开源权重图像模型,X-Omni 英文 OCR 文字渲染得分为 0.97,行业平均为 0.30–0.50。
Google DeepMind 发布 Gemini Robotics 2,包含三款模型:负责视觉-语言-动作的 Gemini Robotics 2、负责具身推理的 Gemini Robotics ER 2,以及本地运行的 Gemini Robotics On-Device 2。
Poe 宣布可在其平台试用 Anthropic 最新模型 Claude Opus 5,并称这是迄今能力最强的 Opus 模型,以一半价格接近 Claude Fable 5 级别的智能。该模型在智能体编码、知识工作、视觉理解和长时任务上有明显提升,试用入口为 poe.com/Claude-Opus-5。
Google 用 Gemini 3.5 Flash-Lite 演示大规模重复性视觉任务,在 100 万+ 张商品目录图片上批量提取原始特征并转化为干净的结构化数据。该模型以低延迟和 token 效率满足大规模工作流需求。
月之暗面在 Kimi K3 开放日发布 Kimi K3 模型权重、技术报告,并开源支撑其训练的关键 Infra 技术 MoonEP、FlashKDA 和 AgentEnv。
Kimi K3 开放权重、技术报告与 Infra 技术,读者可了解其 2.8 万亿参数 MoE 与 3 倍规模化效率的具体做法。
月之暗面在 Kimi K3 开放日发布 Kimi K3 模型权重与技术报告,并开源支撑其训练的关键 Infra 技术 MoonEP、FlashKDA 和 AgentEnv。
月之暗面公开最强模型的权重与技术报告,并同时开源三项训练 Infra 技术,读者可据此了解其规模效率的实现路径。
Google Gemma 本周下载量突破 9 亿次,官方称即将达到 10 亿。博主 Patrick Loeber 同期发布博客,介绍如何将 Gemma 4 作为本地编程智能体运行。
月之暗面发布 Kimi K3,一个 2.8 万亿参数的多模态模型,具备 1M token 上下文窗口和原生视觉能力。
读者可看到 2.8T 参数开源模型在发布当天上线的推理性能数据与 Moonshot 的架构取舍,理解大模型可服务性背后的工程细节。
Gemma 4 模型下载量已超过 3 亿次,整个 Gemma 开源模型系列的累计下载量则突破 9 亿次。这一数据由 Demis Hassabis 发文澄清,并引用了 Olivier Lacombe 关于 Gemma 模型家族跨过 9 亿次下载里程碑的推文。
Midjourney 发布 V8.2,并将其设为平台默认模型。官方称此次更新聚焦美学、个性化与图像质量,新风格更具创意、大胆、前卫和新鲜感,个性化效果也优于以往。
Anthropic 发布 Claude Opus 5,称其是一款善于思考且主动的模型,能力接近 Fable 5,价格只有后者一半。转发的评论者注意到此次还下调了 prompt cache 的最低额度,认为这是基础设施层面的推进。
Anthropic 发布 Claude Opus 5,称其是一款主动且考虑周全的模型,具备接近 Fable 5 的前沿智能水平,价格为其一半。作者表示该模型擅长长时间自主运行的任务,邀请用户试用并反馈。
Anthropic 发布 Opus 5,团队称在提升智能水平的同时大幅优化了该模型在各领域的 token 效率。Alex Albert 表示其使用体验非常顺滑,在许多编码任务上他更偏好 Opus 5 而非 Fable 5。
Anthropic 发布 Claude Opus 5,官方称其思考更主动,接近 Fable 5 的前沿智能水平,价格仅为其一半。Mike Krieger 表示 Opus 5 迅速成为他工作和周末的日常主力模型,能连续数小时处理复杂任务,并称其能持续深挖棘手问题;他还用它构建了一些游戏。
Anthropic 发布 Claude Opus 5,称其为兼顾思考与主动性的模型,智能水平接近 Fable 5,价格只有后者一半。转述者 Alex Albert 以欢迎语转发该消息,未在推文中给出更多技术细节。
Claude Opus 5 发布,被 Anthropic 描述为一款深思熟虑且主动的模型,智能水平接近 Fable 5,但价格只有后者的一半。AI SDK 已支持接入该模型。
MAI-Image-2.5-Pro 今日在 Foundry 开放预览,Microsoft 称其为最高保真度的专业级图像模型。该模型面向超高质量图像、精细编辑和图像内文字精确渲染,并与同家族其他图像模型一起供开发者按质量、速度、成本的权衡选择。
MAI-Voice-2-Flash 正式发布,速度比 MAI-Voice-2 快 2 倍,价格便宜 32%,为每 100 万字符 $15。该模型已进入公开预览,并已驱动企业呼叫中心平台 Dynamics 365 Contact Center,可将 GPU 成本最高降低 89%。
微软正在推进 MAI 系列模型的落地,覆盖 PowerPoint、OneDrive、Bing、Dragon Copilot 等产品。PowerPoint 图像模型成本较 GPT-Image-2 下降 84%,OneDrive 保存率提升 26%、延迟降低约 25%,Bing 已将其作为默认模型。Dragon Copilot 转写模型支持 58 种语言,多语言临床转写错误率减半。
Gemini 3.6 Flash 与 3.5 Flash-Lite 发布 24 小时后,官方称已收集并正在审阅超过 1K 条回复,认为这一时间虽早,但已能清晰看出需要改进的方向。团队表示目标是在真实世界任务与效率上大幅推进这两款模型,并称"还需要继续推进"。
腾讯最新模型 Hy3 已在 OpenCode 上线,可在 Go text 中调用,支持 256K 上下文。该消息由 Hunyuan 官方账号发布。
微软研究发布 MagenticLite 和 Fara1.5 两款模型,并提供入门指南、模型入口及 Fara1.5 的博客与技术报告。相关资源已在 Models 页面开放获取。
Kimi K3 上周发布,Qwen 宣布下一代大模型将采用开放权重,中国厂商在开源模型上的加速成为焦点。播客讨论了 GLM 5.2 的作用、美国开源生态、前沿与近前沿模型差距,以及蒸馏话题引发的 Ben Thompson 争论。
Gemini 3.6 Flash 与 3.5 Flash-Lite 发布后征集反馈,目标是让这两个模型在真实世界任务和效率上有大幅提升。发布者向用户征询使用 24 小时后的真实评价。
Grok 4.5 使用体验获好评,Dan Shipper 称其已成为 Kieran Klaassen 第二常用的模型,并直言需要更新自己的认知。
Google DeepMind 发布 Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite。Box 的评测显示,Gemini 3.5 Flash-Lite 在真实企业文档任务上整体准确率为 58%,高于 Gemini 3.1 Flash-Lite 的 41%,其中数据分析提升 27pp、零售提升 28pp。Box 称其速度更快、体量更轻。
Browser Use 表示,Gemini 3.6 Flash 是他们测试过的浏览器智能体中性价比最高的模型,在其 BU Benchmark 上达到 68%。该成绩超过 GPT-5.6-sol 的 67% 和 Sonnet 4.6 的 62%,仅次于 Opus 4.8 的 74%,但成本仅为后者的一小部分。
OpenCode 现已接入 Gemini 3.6 Flash 和 3.5 Flash Lite,均支持 1M 上下文。其中 3.6 Flash 的输出价格比 3.5 Flash 便宜 17%,Flash Lite 则便宜 80%。
Vercel 将 Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 接入 AI Gateway,模型标识分别为 'google/gemini-3.6-flash' 和 'google/gemini-3.5-flash-lite'。开发者可经 Vercel AI Gateway 调用这两款模型。
Google 展示了合作伙伴如何把最新的 Gemini 3.6 Flash 和 3.5 Flash-Lite 模型集成进用户日常使用的工具中。原文未披露具体合作方、参数规模或 benchmark 数据。
Gemini 3.6 Flash 已在 Antigravity 上线。发布者同时宣布重置所有人的每周配额,方便用户继续构建。
Google 推出 Gemini 3.5 Flash Cyber,基于 3.5 Flash 构建,在 CyberGym 等基准上达到前沿竞争力,面向规模化发现与修复网络安全漏洞场景优化,成本更低。该模型将在 AI 代码安全智能体 CodeMender 中独家提供给政府和可信伙伴,作为限时访问试点项目的一部分。鉴于技术的双用途性质,Google 对部署采取了审慎方式。
Google 发布 Gemini 3.5 Flash-Lite,官方称其是面向低延迟、高吞吐开发者工作流的最快且最具成本效益的模型。该模型针对规模化重复任务、并行 subagent、agentic search 和大批量文档处理做了优化。