跳到正文

#模型发布

今日 19 条
7月30日周四
  1. Google DeepMindAI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 发布 Gemini Robotics 2,展示机器人协同

    Google DeepMind 发布 Gemini Robotics 2,并展示了机器人之间协同工作的能力。

  2. Ideogram(@ideogram_ai)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ideogram 与 PrunaAI 联合发布 P-Image-Ideogram 图像模型家族

    Ideogram 发布 P-Image-Ideogram 图像模型家族,与 PrunaAI 联合开发,主打质量、速度与成本之间的帕累托最优权衡。该家族提供四种质量模式,支持原生 1K 和 2K 生成,每张图像起价 0.003 美元,现已在 API 及所有合作平台上线。

  3. xAI(@xai)AI 评估 · 59/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    xAI 发布下一代语音模型 Grok Voice Think Fast 2.0

    xAI 发布下一代语音模型 Grok Voice Think Fast 2.0,官方称其在智能水平、转写准确率和对话能力上均有提升。相关介绍见 x.ai/news/grok-voic…。

  4. xAI(@xai)AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    xAI 推出 Grok Voice Think Fast 2.0,面向真实场景语音智能体

    xAI 发布 Grok Voice Think Fast 2.0,专为真实世界语音智能体打造,可在嘈杂环境中清晰收音,能对复杂工作流进行推理,对话听起来也更自然。

  5. v0(@v0)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    v0 支持开放权重模型,首发 Kimi K3

    v0 现已支持使用开放权重模型,首个接入的是 Kimi K3,可在 v0.app/?kimi3 试用。

  6. Google DeepMind BlogAI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 在 Google Flow Music 发布 Lyria 3.5 音乐生成模型

    Google DeepMind 发布新一代音乐生成模型 Lyria 3.5,并在 Google Flow Music 中上线。官方称该模型在音乐性、歌词和人声质量上均有提升,包括更丰富复杂的旋律结构、提示词遵循与结构感知更好的歌词、更具情感表现力和发音更准的人声,同时可更便捷地控制输出的节奏与时长。

7月29日周三
  1. Jina AIAI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jina Reranker v3.5 发布:0.6B 列表式重排器,专攻垂直领域与结构化数据

    Jina AI 推出 jina-reranker-v3.5,保持 0.6B 参数规模和 LBNL 列表式架构,专门解决垂直领域适配、结构化记录逻辑识别和长列表显存爆炸三大工程痛点。

  2. Ideogram(@ideogram_ai)AI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ideogram 发布 9.3B 开源图像模型 Ideogram 4.0,与 AMD 合作规模化部署

    Ideogram 发布 Ideogram 4.0,一个 9.3B 参数的开源权重 Diffusion Transformer 图像模型,称其在 LMArena 和 Design Arena 上超过所有开源权重图像模型,X-Omni 英文 OCR 文字渲染得分为 0.97,行业平均为 0.30–0.50。

7月28日周二
  1. Google DeepMind BlogAI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 发布 Gemini Robotics 2,为机器人带来全身智能

    Google DeepMind 发布 Gemini Robotics 2,包含三款模型:负责视觉-语言-动作的 Gemini Robotics 2、负责具身推理的 Gemini Robotics ER 2,以及本地运行的 Gemini Robotics On-Device 2。

  2. Poe(@poe_platform)AI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Poe 上线 Claude Opus 5,Anthropic 称其为最强 Opus 模型

    Poe 宣布可在其平台试用 Anthropic 最新模型 Claude Opus 5,并称这是迄今能力最强的 Opus 模型,以一半价格接近 Claude Fable 5 级别的智能。该模型在智能体编码、知识工作、视觉理解和长时任务上有明显提升,试用入口为 poe.com/Claude-Opus-5。

  3. Google AI Developers(@googleaidevs)AI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 3.5 Flash-Lite 演示处理 100 万+ 图片的视觉任务

    Google 用 Gemini 3.5 Flash-Lite 演示大规模重复性视觉任务,在 100 万+ 张商品目录图片上批量提取原始特征并转化为干净的结构化数据。该模型以低延迟和 token 效率满足大规模工作流需求。

7月27日周一
  1. 月之暗面 KimiAI 评估 · 85/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Kimi K3 开放日:模型权重、技术报告与关键 Infra 技术同步开放

    月之暗面在 Kimi K3 开放日发布 Kimi K3 模型权重、技术报告,并开源支撑其训练的关键 Infra 技术 MoonEP、FlashKDA 和 AgentEnv。

    为什么值得看

    Kimi K3 开放权重、技术报告与 Infra 技术,读者可了解其 2.8 万亿参数 MoE 与 3 倍规模化效率的具体做法。

  2. 月之暗面 KimiAI 评估 · 85/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Kimi K3 开放日:模型权重、技术报告与三项 Infra 技术同步开放

    月之暗面在 Kimi K3 开放日发布 Kimi K3 模型权重与技术报告,并开源支撑其训练的关键 Infra 技术 MoonEP、FlashKDA 和 AgentEnv。

    为什么值得看

    月之暗面公开最强模型的权重与技术报告,并同时开源三项训练 Infra 技术,读者可据此了解其规模效率的实现路径。

  3. Patrick Loeber(@patloeber)AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemma 下载量逼近 10 亿,Gemma 4 本地编程智能体教程发布

    Google Gemma 本周下载量突破 9 亿次,官方称即将达到 10 亿。博主 Patrick Loeber 同期发布博客,介绍如何将 Gemma 4 作为本地编程智能体运行。

  4. Modal BlogAI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    月之暗面发布 Kimi K3,Modal 发布首日上线并给出推理性能数据

    月之暗面发布 Kimi K3,一个 2.8 万亿参数的多模态模型,具备 1M token 上下文窗口和原生视觉能力。

    为什么值得看

    读者可看到 2.8T 参数开源模型在发布当天上线的推理性能数据与 Moonshot 的架构取舍,理解大模型可服务性背后的工程细节。

7月26日周日
  1. Demis Hassabis(@demishassabis)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemma 4 下载量超 3 亿次,Gemma 开源模型系列累计突破 9 亿次

    Gemma 4 模型下载量已超过 3 亿次,整个 Gemma 开源模型系列的累计下载量则突破 9 亿次。这一数据由 Demis Hassabis 发文澄清,并引用了 Olivier Lacombe 关于 Gemma 模型家族跨过 9 亿次下载里程碑的推文。

7月25日周六
  1. Midjourney(@midjourney)AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Midjourney 发布 V8.2 并设为默认模型

    Midjourney 发布 V8.2,并将其设为平台默认模型。官方称此次更新聚焦美学、个性化与图像质量,新风格更具创意、大胆、前卫和新鲜感,个性化效果也优于以往。

  2. Patrick Loeber(@patloeber)AI 评估 · 70/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Opus 5,称接近 Fable 5 能力且价格减半

    Anthropic 发布 Claude Opus 5,称其是一款善于思考且主动的模型,能力接近 Fable 5,价格只有后者一半。转发的评论者注意到此次还下调了 prompt cache 的最低额度,认为这是基础设施层面的推进。

  3. cat(@_catwu)AI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Opus 5,主打长时自主运行任务

    Anthropic 发布 Claude Opus 5,称其是一款主动且考虑周全的模型,具备接近 Fable 5 的前沿智能水平,价格为其一半。作者表示该模型擅长长时间自主运行的任务,邀请用户试用并反馈。

  4. Alex Albert(@alexalbert__)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Opus 5 发布:跨领域 token 效率与智能水平同步提升

    Anthropic 发布 Opus 5,团队称在提升智能水平的同时大幅优化了该模型在各领域的 token 效率。Alex Albert 表示其使用体验非常顺滑,在许多编码任务上他更偏好 Opus 5 而非 Fable 5。

  5. Mike Krieger(@mikeyk)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Opus 5

    Anthropic 发布 Claude Opus 5,官方称其思考更主动,接近 Fable 5 的前沿智能水平,价格仅为其一半。Mike Krieger 表示 Opus 5 迅速成为他工作和周末的日常主力模型,能连续数小时处理复杂任务,并称其能持续深挖棘手问题;他还用它构建了一些游戏。

  6. Alex Albert(@alexalbert__)AI 评估 · 69/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 推出 Claude Opus 5

    Anthropic 发布 Claude Opus 5,称其为兼顾思考与主动性的模型,智能水平接近 Fable 5,价格只有后者一半。转述者 Alex Albert 以欢迎语转发该消息,未在推文中给出更多技术细节。

  7. AI SDK(@aisdk)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    在 AI SDK 中使用 Claude Opus 5

    Claude Opus 5 发布,被 Anthropic 描述为一款深思熟虑且主动的模型,智能水平接近 Fable 5,但价格只有后者的一半。AI SDK 已支持接入该模型。

7月24日周五
  1. Mustafa Suleyman(@mustafasuleyman)AI 评估 · 59/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Microsoft 发布 MAI-Image-2.5-Pro 图像模型并在 Foundry 开放预览

    MAI-Image-2.5-Pro 今日在 Foundry 开放预览,Microsoft 称其为最高保真度的专业级图像模型。该模型面向超高质量图像、精细编辑和图像内文字精确渲染,并与同家族其他图像模型一起供开发者按质量、速度、成本的权衡选择。

  2. Mustafa Suleyman(@mustafasuleyman)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MAI-Voice-2-Flash 发布:比 MAI-Voice-2 快 2 倍、便宜 32%

    MAI-Voice-2-Flash 正式发布,速度比 MAI-Voice-2 快 2 倍,价格便宜 32%,为每 100 万字符 $15。该模型已进入公开预览,并已驱动企业呼叫中心平台 Dynamics 365 Contact Center,可将 GPU 成本最高降低 89%。

  3. Mustafa Suleyman(@mustafasuleyman)AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软 MAI 模型进展:PowerPoint 图像模型成本较 GPT-Image-2 降 84%

    微软正在推进 MAI 系列模型的落地,覆盖 PowerPoint、OneDrive、Bing、Dragon Copilot 等产品。PowerPoint 图像模型成本较 GPT-Image-2 下降 84%,OneDrive 保存率提升 26%、延迟降低约 25%,Bing 已将其作为默认模型。Dragon Copilot 转写模型支持 58 种语言,多语言临床转写错误率减半。

7月23日周四
  1. Patrick Loeber(@patloeber)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 3.6 Flash 与 3.5 Flash-Lite 发布 24 小时后的反馈征集

    Gemini 3.6 Flash 与 3.5 Flash-Lite 发布 24 小时后,官方称已收集并正在审阅超过 1K 条回复,认为这一时间虽早,但已能清晰看出需要改进的方向。团队表示目标是在真实世界任务与效率上大幅推进这两款模型,并称"还需要继续推进"。

  2. Hunyuan(@TXhunyuan)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯 Hy3 上线 OpenCode,支持 Go text 与 256K 上下文

    腾讯最新模型 Hy3 已在 OpenCode 上线,可在 Go text 中调用,支持 256K 上下文。该消息由 Hunyuan 官方账号发布。

  3. Microsoft Research(@MSFTResearch)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软发布 MagenticLite 与 Fara1.5 模型:入门指南与技术报告

    微软研究发布 MagenticLite 和 Fara1.5 两款模型,并提供入门指南、模型入口及 Fara1.5 的博客与技术报告。相关资源已在 Models 页面开放获取。

7月22日周三
  1. Interconnects AI — Nathan LambertAI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Kimi K3 与 Qwen 3.8 之后:开源模型综述、蒸馏争论与中美差距

    Kimi K3 上周发布,Qwen 宣布下一代大模型将采用开放权重,中国厂商在开源模型上的加速成为焦点。播客讨论了 GLM 5.2 的作用、美国开源生态、前沿与近前沿模型差距,以及蒸馏话题引发的 Ben Thompson 争论。

  2. Patrick Loeber(@patloeber)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 3.6 Flash 与 3.5 Flash-Lite 寻求真实任务与效率反馈

    Gemini 3.6 Flash 与 3.5 Flash-Lite 发布后征集反馈,目标是让这两个模型在真实世界任务和效率上有大幅提升。发布者向用户征询使用 24 小时后的真实评价。

  3. Sualeh Asif(@sualehasif996)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok 4.5 上手感获好评,成为重度用户第二常用模型

    Grok 4.5 使用体验获好评,Dan Shipper 称其已成为 Kieran Klaassen 第二常用的模型,并直言需要更新自己的认知。

  4. Google AI Developers(@googleaidevs)AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 3.5 Flash-Lite 对比 3.1 Flash-Lite:企业文档任务准确率 58% vs 41%

    Google DeepMind 发布 Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite。Box 的评测显示,Gemini 3.5 Flash-Lite 在真实企业文档任务上整体准确率为 58%,高于 Gemini 3.1 Flash-Lite 的 41%,其中数据分析提升 27pp、零售提升 28pp。Box 称其速度更快、体量更轻。

  5. Google AI Developers(@googleaidevs)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Browser Use 称 Gemini 3.6 Flash 在 BU Benchmark 达 68%

    Browser Use 表示,Gemini 3.6 Flash 是他们测试过的浏览器智能体中性价比最高的模型,在其 BU Benchmark 上达到 68%。该成绩超过 GPT-5.6-sol 的 67% 和 Sonnet 4.6 的 62%,仅次于 Opus 4.8 的 74%,但成本仅为后者的一小部分。

  6. Google AI Developers(@googleaidevs)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenCode 上线 Gemini 3.6 Flash 与 3.5 Flash Lite,支持 1M 上下文

    OpenCode 现已接入 Gemini 3.6 Flash 和 3.5 Flash Lite,均支持 1M 上下文。其中 3.6 Flash 的输出价格比 3.5 Flash 便宜 17%,Flash Lite 则便宜 80%。

  7. Google AI Developers(@googleaidevs)AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 3.6 Flash 与 Gemini 3.5 Flash-Lite 上线 Vercel AI Gateway

    Vercel 将 Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 接入 AI Gateway,模型标识分别为 'google/gemini-3.6-flash' 和 'google/gemini-3.5-flash-lite'。开发者可经 Vercel AI Gateway 调用这两款模型。

  8. Google AI Developers(@googleaidevs)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    合作伙伴如何将 Gemini 3.6 Flash 与 3.5 Flash-Lite 集成进日常工具

    Google 展示了合作伙伴如何把最新的 Gemini 3.6 Flash 和 3.5 Flash-Lite 模型集成进用户日常使用的工具中。原文未披露具体合作方、参数规模或 benchmark 数据。

  9. Varun Mohan(@_mohansolo)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 3.6 Flash 上线 Antigravity,全体每周配额重置

    Gemini 3.6 Flash 已在 Antigravity 上线。发布者同时宣布重置所有人的每周配额,方便用户继续构建。

  10. Google AI(@GoogleAI)AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 发布 Gemini 3.5 Flash Cyber,专攻网络安全漏洞

    Google 推出 Gemini 3.5 Flash Cyber,基于 3.5 Flash 构建,在 CyberGym 等基准上达到前沿竞争力,面向规模化发现与修复网络安全漏洞场景优化,成本更低。该模型将在 AI 代码安全智能体 CodeMender 中独家提供给政府和可信伙伴,作为限时访问试点项目的一部分。鉴于技术的双用途性质,Google 对部署采取了审慎方式。

  11. Google AI Developers(@googleaidevs)AI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 发布 Gemini 3.5 Flash-Lite

    Google 发布 Gemini 3.5 Flash-Lite,官方称其是面向低延迟、高吞吐开发者工作流的最快且最具成本效益的模型。该模型针对规模化重复任务、并行 subagent、agentic search 和大批量文档处理做了优化。