小米发布 MiMo V2.6 系列模型并全面开源
小米发布 MiMo-V2.6 系列,含 Pro、Flash 和 20 倍速的 Pro-UltraSpeed 三个版本,AA 指数 46 分与同日发布的 Grok 4.7 打平,位列开源模型第一。
为什么值得看
作者以实测视角对比 Grok 4.7 与 MiMo V2.6 的性能、价格和速度,呈现国产开源模型的实际能力边界。
小米发布 MiMo-V2.6 系列,含 Pro、Flash 和 20 倍速的 Pro-UltraSpeed 三个版本,AA 指数 46 分与同日发布的 Grok 4.7 打平,位列开源模型第一。
作者以实测视角对比 Grok 4.7 与 MiMo V2.6 的性能、价格和速度,呈现国产开源模型的实际能力边界。
Aikido 发布首个开源权重安全模型 Altar-1,具备接近前沿水平的防御能力,其基础是开源 SOTA 模型 GLM 5.3 的剪枝量化版本,轻量到可装进单个 4-H200s 节点。
Browser Use 与 Jev 联合推出开源浏览器智能体 Ultrafast。据推文数据,Ultrafast 4 天内获得 15k 星标,查询航班耗时 7 秒、花费 0.0039 美元。其设计包含每一步都有新的 action space、DOM 状态空间,以及回退到小 LLM 执行输入,演示视频为 1 倍速。
White Circle 发布开源模型后训练框架 Halo,吞吐量最高达原生 TRL 的 2.8 倍,峰值内存更低,且模型保持 HuggingFace 原生格式。HuggingFace CEO Clement Delangue 转发称,借助智能体,训练模型正变得越来越容易。
小米发布开源模型 MiMo-V2.6-Pro,支持文本、图像、音频、视频多模态,权重已上传 Hugging Face。Artificial Analysis 数据显示其在 Intelligence Index 上得分 46,超过前代 MiMo-V2.5-Pro 的 26,位列开源权重模型首位。
小米开源 MoE 多模态模型,公开权重、定价与第三方指数对比,可据此判断开源与闭源的成本差距。
小米发布开源权重模型 MiMo-V2.6-Pro,在 Artificial Analysis 智能指数上得 46,成为该榜单最高分开源模型,前代 MiMo-V2.5-Pro 为 26。
Thomas Wolf 认为,在 RLVR 新范式下,发布大量高质量开源 RL 环境相当于当年共享高质量预训练数据,是当下推动开源前沿最有影响力的事。他转述 eliebakouch 的说法称,对方将开源约 7k RL 训练数据及框架,并已发布模型与技术报告,距启动最终 RL 训练不到 1 周。
Nat Friedman 表示 muse 是从零构建的,但产品上深受 openclaw 启发。他在 1 月使用 openclaw 后为 MSL 团队购入数百台 Mac mini,团队许多人爱上了 openclaw 及其他个人智能体,他认为 @steipete 的 harness 从一开始就具有开创性。muse 的目标是打造类似 openclaw 但安全、易用、可扩展至数十亿人的产品。
Thomas Wolf 列出 Dylan Patel 访谈后约 10 周内的开源模型发布,包括 Thinking Machines Inkling、Moonshot Kimi K3、DeepSeek V4-Flash-0731 与 V4-Pro-0813、Qwen3.8-Max、Z.ai GLM-5.3、Meta Muse Spark 1.2 等。
Hugging Face 联合创始人 Julien Chaumond 指出,"决策模型"(Decision model)只是"零样本分类"(zero-shot classification)的新名字。Clem Delangue 转发称,在 Hugging Face 上可按对应 pipeline 找到适用于 Jev 任务的开放模型。
Hugging Face 联合创始人 Clem 表示,大型通用模型长期吸走了 AI 领域几乎所有关注,但针对特定任务和语言构建的专用、定制模型存在巨大机会,成本可低几个数量级,也更快、更优化。他提到 Hugging Face 上已有 300 万个此类公开模型,呼吁构建更多元化的 AI 生态。
LangSmith Gateway 将开源决策模型 SemIf 免费开放一周,该模型基于 Qwen3.5。SemIf 属于新型的 decision models(决策模型),兼容 TypeSafe SDK,只需改动一个字符串即可试用。
NVIDIA 公布 GTC Berlin Golden Ticket 六位获奖者:Lucas Hudson、James Kane、Devin Nicholson、Aaron Nowak、Vladimir Shirokun、Stefan Trauth,他们下月将前往柏林参会。
Nathan Lambert 公开其为美国国会简报准备的开源权重模型现状讲稿,认为中国实验室在开源权重模型上已确立明显领先。
阶跃星辰发布 Step 5 Preview,采用稀疏 MoE 架构,总参数 600B、每 Token 激活 27B,支持 100 万 Token 上下文与视觉输入,已通过阶跃产品与 API 提供,完整权重计划于 10 月 15 日发布。
小米 AI 硬创团队开源了四件 AI 硬件探索作品:AI 记忆配饰 DayoTag 采用无服务端本地记录并支持扩展 Skill;哈基米 PetAgent 把 Agent 运行状态同步到桌面摆件。
Qwen 回应网友提问时明确,模型输出不属于授权 Materials 的一部分,用户对自己使用该模型生成的图片及其他内容保留权利。
前沿模型发布后 6-12 个月中国开源权重模型追平差距,这周模式变了:jev 发布几天后,大批美国 AI 开发者跟进推出自己的开源权重模型。目前只追踪到 2-3 个早期案例,预计一周内还会有更多开源权重替代方案,也应该会有针对 jev 的中国开源权重替代品。
SGLang-Diffusion 已支持 Qwen-Image-2.1,提供文生图、多图编辑和透明 RGBA 输出。单张 RTX 4090 24GB 配合 CPU offload 可在 18.7s 生成 1024×1024 图像、21.7s 完成图像编辑,峰值显存 22.7 GiB;RTX PRO 6000 96GB 上分别为 8.0s 和 9.6s。
与字幕组"被AI取代"的预期相反,受访汉化者普遍欢迎AI:Eliza的字幕组借模型听写和自搓翻译Skill,把原本3到5小时的打轴压缩到20分钟至1小时,组员多转入校对;程序员阵雨则一人包办听写、拆句与翻译,两小时直播当晚即出中文字幕。漫画汉化因嵌字排版细节仍以人工为主,组长岸边坚持古法手搓,但也接受后来者习惯AI翻译的那一天。
Qwen-Image-2.1 现已支持在 ComfyUI 中使用,并开放权重,单个 7B checkpoint 同时支持生成和编辑。该模型支持原生 2K 图像生成、单次基于最多 10 张参考图的指令编辑,以及包含 alpha 通道的 RGBA 输出。
阿里 Qwen 发布 Qwen-Image-2.1,称其为 Qwen-Image 系列中平衡性与性价比最佳的图像生成模型,并已开放权重。该模型是生成与编辑统一模型,采用 7B 轻量架构,支持多图输入推理加速、原生 RGBA 透明图层生成与编辑、最多 10 张参考图的高保真编辑,并覆盖全景图、信息图和虚拟试穿等场景。权重已在 Hugging Face、ModelScope 和 GitHub 提供。
阶跃发布面向真实世界 Agentic 任务的旗舰基座模型 Step 5 Preview,采用稀疏 MoE 架构,总参数量 600B、激活参数 27B,支持 100 万 Token 上下文窗口并原生支持文本与视觉输入。
MiniMax 发布六个全球合作案例,涵盖新加坡 Singtel AI Pass 上线 MiniMax Agent、海螺 AI 和 MiniMax Audio,东京发布 MiniMax H3 IP 版,以及 Genspark 基于 MiniMax M3 后训练出 PPT 模型 Gen-1 Slides。
Cerebras 基于 Qwen 3.8 27B 构建了个人理财助手 Money Agent,可把买房问题变成实时对话并进一步转化为财务目标。该助手运行在 Cerebras 上,官方称速度"比以往更快"。
歸藏开源了 Skill guizang-product-video-skill(https://github.com/op7418/guizang-product-video-skill),用纯前端代码渲染产品宣传片,不依赖视频生成模型。
PrismML 发布 Ternary Bonsai 2 27B,基于 Qwen3.8 27B,体积比全精度版本小 9 倍,仍保留 98.2% 的聚合基准性能,占用空间 5.9 GB,以 Apache 2.0 协议开放使用。
Fireworks 宣布为 @phylo_bio 提供 day-zero 访问和快速无服务器推理路径,让研究智能体能触达更多科学家。该推文指出开放模型在生物学领域能力日益增强,但部署服务难度更高。
Milvus 在 GitHub 上的 star 数达到 46K,官方发文感谢社区贡献者。Milvus 3.0 将带来新的存储格式、索引、查询能力、原生文本去重和行级 TTL 等功能,官方将于 9 月 23 日举办 Milvus 2.6 → 3.0 升级 webinar,由 Jael Gu 和 Jiang Chen 讲解升级路径。
Qdrant 举办的 Vector Space Stream 直播结束,全程超过 4 小时,覆盖 token 原生存储、向量压缩、机器人、新型嵌入向量几何、双编码器、自适应混合搜索、十亿级规模评估以及计算与存储分离等主题。错过直播的观众现可在 YouTube 观看回放,并可通过 Qdrant 的 Discord 社区继续讨论。
SemiAnalysis 披露其公司 AI token 开销已占员工薪酬的 30%,每位员工每月消耗约 50 亿 token。文章指出模型开源与 Agent 开源是两件事,真正承载用户资产的是负责调度模型、连接工具、管理记忆的 Agent Runtime,并以 DeepSeek Harness、网易有道 LobsterAI 为例讨论执行层开源。
阿里巴巴达摩院联合浙江大学医学院附属第一医院等机构研发的通用医疗影像AI模型DAMO RADAR登上《科学》(Science),面向腹部增强CT诊断,可一次识别超过146种病症、覆盖18个器官,平均AUC达0.913,现已正式开源。
阿里发布 Qwen3.8-Omni-Flash,称其为 Qwen 首个围绕智能体能力构建的全模态模型,将原生音视频理解、推理与工具调用整合在同一模型中,实现理解内容、规划任务、用工具执行并交付结果。
一篇综述把 Agent 的能力来源从模型转向模型之外的 Harness,按「一个循环、四个子系统、生产化、长时运行、评测、选型」展开。
Hacktron 在 2026 年 8 月报告 Next.js 图像优化疑似存在远程代码执行(RCE)漏洞,Vercel 与 Hacktron 复现后确认问题代码不在 Next.js 本身,而在上游被 Next.js、ImageMagick、WordPress、sharp 等广泛使用的 AVIF 解码器 libheif。
Equinix 将原先自建在 Amazon EC2 上的自管理 Kubernetes 迁移到 Amazon EKS,改用多账号共享服务架构:Workloads、Platform、Network 三个核心账号分别承载应用服务、共享基础设施与网络枢纽,由云运维团队集中治理。成效包括部署速度提升 4 倍,运维开销显著下降。
LangChain 发布开源智能体助手 Deep Life Sci,面向临床与实验室科学家,基于其 Deep Agents harness 构建。
Jina AI 推出 OCR 模型 jina-ocr-v1,已在 Hugging Face 上线可直接使用,并同步放出技术报告与模型博客。官方同时向用户征集使用反馈。
Milvus 发布教程,介绍如何把 Milvus 用作 EverOS 的搜索后端。EverOS 来自 @evermind,GitHub 星标超过 13,000,用 LLM 从对话中提取记忆并保存为 Markdown 文件,让智能体跨对话保留长期记忆。
太初团队开源 ZDTaichu5.0-9B 空间理解模型,结合 Qwen3.5-9B 语言骨干与 C-RADIOv4-H 视觉编码器,支持文本、图片、视频输入,覆盖文档、图表、OCR 与视觉问答,并已提供权重、本地推理示例和适配的 vLLM 服务镜像。