模型开放之后,AI 能力为什么仍难以复用?
AI 开源的价值正从"开放了什么"转向"开放的能力能否被验证、复用和持续迭代"。2026 年世界人工智能开源大赛(GOAI)覆盖 91 个国家和地区、吸引超 1.4 万名开发者,收到 2999 份有效初赛作品,70 个项目进入总决赛,多 Agent 协作与 Skill 调用成为工程考察重点。
AI 开源的价值正从"开放了什么"转向"开放的能力能否被验证、复用和持续迭代"。2026 年世界人工智能开源大赛(GOAI)覆盖 91 个国家和地区、吸引超 1.4 万名开发者,收到 2999 份有效初赛作品,70 个项目进入总决赛,多 Agent 协作与 Skill 调用成为工程考察重点。
国产操作系统已有银河麒麟、统信UOS、deepin、openEuler、龙蜥Anolis、鸿蒙PC等数十个发行版,但底层几乎都是Linux。
技嘉 10 月 9 日宣布,全部 B760 和 H610 主板将通过 BIOS 更新支持预计 2027 年初推出的新款英特尔 LGA1700 处理器,其中包含 DDR4 主板。
Simon Willison 提问:在 60GB 内存限制下,最适合编程的开源权重 MoE 大模型是哪款?他表示在自己可用的硬件上可能需要 MoE 才能达到可接受的交互速度,希望快于 12 tokens/秒。
2026 年 9 月 GitHub 十大热门项目榜单从约 23 个候选中选出 ponytail、ECC、open-code-review、hindsight、WeKnora、cua 等十个项目,覆盖编码 Skill、Agent Harness、代码评审、Agent Memory、知识 RAG 与 Computer-Use 等方向。
Hugging Face 旗下 Pollen Robotics 设计的机器鸭 Microduck 售价 399 美元,高峰期平均每 4 秒卖出一台,五天后预售破万台、销售额突破 500 万美元,由潘昊创办的深圳 Seeed Studio 矽递科技代工。
Opus 5.5 发布并被指代码能力再次飞跃,深度和广度已超越 99% 的程序员,完成同样任务所需生成的代码输出反而更少。有开发者用它直接反编译二进制、几十分钟做出可玩游戏 demo,也有人靠 AI 重写代码绕开 GPL 传染;Muse 为 ESP32 提供 Agent Ready 通用固件,模型推理成本最近一周大幅下降,Strata 可把推理速度提升数倍。
阿里云智能集团副总裁安筱鹏在2026云栖大会汽车行业峰会上提出,AI正同步重构汽车产业的经济模型、产品形态与竞争规则,使行业呈现高固定成本、低边际成本特征。全球汽车产业利润池中传统业务占比将从2021年的90%降至2035年的44%,Robotaxi市场年复合增长率超88%,2035年规模达1300亿~4150亿美元。自动驾驶、智能座舱、AI生产力由此成为三大竞技场。
LangSmith 评测中的 Jev 判官把轨迹标注拆成多个问题,难度和正确性各自得到带类型的答案,且在一次 pass 中、对每条 trace 完成。该框架认为轨迹标注需覆盖任务难度、方案正确性、设计选择多样性和思考方向等维度,规模化标注百万级 agent 及其子 agent 的 token 成本仍待大幅降低。
Spring AI Alibaba 最后一个正式版 v1.1.2.2 发布于 2026 年 3 月 10 日,此后半年无新正式版,但 main 分支仍有提交,8 月 25 日还有最新 commit,v1.1.2.2 之后共合并 137 个提交,以修复和测试为主。
阿里在「AI Native 研发范式实践手册」结尾给出四点官方陈述:从写代码到可靠交付仍有较多技术问题待解,基础设施工程复杂度可能不亚于 Agent 应用层建设。企业知识资产尚未做到 Agent 友好,结构化、版本化、权限管理与质量治理仍有大量工作;组织设计影响更深远且更难有确定答案,AI 迭代速度还会持续冲击现有架构,需保持架构适应弹性。
一位开发者给不同性格和技能的多 agent Bot 开放了 GitHub、Cloudflare 和豆包播客 API,让它们自行讨论拍板,最终做出一个 24 小时播报 AI 新闻的电视台。作者称一直不看好 agent 协作,这次有点改观,并表示当天下午会将其开源。
SemiAnalysis 统计 2021 年至 2026 年 9 月 15 日 9 家中国头部开发商的 857 个模型发布,仅 31 个(3.6%)附带开发者公布的安全评估结果,其中只有 9 个(1.1%)在发布时或之前公布。
GitHub Tiny Wins 团队的 Camilla Moraes 做客最新一期 GitHub Podcast,讨论如何应对开源项目中的 AI slop 问题。节目还谈及倾听维护者诉求,以及如何决定下一步修复什么。完整内容可在 YouTube、播客平台或 gh.io/podcast 收听。
Open Source Summit Europe 圆桌讨论指出,欧洲组织实现技术主权不必回避全球技术供应商,但需要可信的替代方案和相应技能。
OpenAI 在 DevDay 发布的 Dots 回到 ChatGPT 式聊天形态,但存在记忆不共享、语音聊天要响两声才接、云电脑完全不开放等缺口;Meta 的 Muse 则提供 SDK 和适配 ESP32 的 AgentReady 通用固件,可直刷设备。
Naval 认为模型是软件最后的护城河:AI 能用文章训练后重写文章、能反编译软件并重新编码、能吸收艺术再创作。但 AI 自身不愿被"蒸馏",预计更多软件会退守服务器端以抵抗"蒸馏"。
Anthropic 发布报告称 GLM-5.3 可作攻击性网络工具,Nathan Lambert 认为这类讨论回避了"禁用开源模型会怎样"等关键问题。他指出,迄今已记录的多数网络攻击由闭源模型导致,若因网络风险禁用开源权重模型,或许也应禁止前沿闭源模型的公开 API。
Harrison Chase 转发并认同 David Cramer 对 coding harness 的判断:Codex harness 实际功能有限,多数 coding harness 也是如此,最终会被更专业的 harness 取代。Cramer 还预测五年内日常任务大多将由本地模型处理,无法本地完成的部分也会被彻底商品化,厂商届时只能靠向用户让利来竞争。
GitHub 用户从 2023 年初的 1 亿增至 2026 年 7 月的 2.25 亿,GitHub 官方也承认无法完全解释这一激增。平台涌现出 chinese-poetry、awesome-chatgpt-prompts、同事.skill 等非代码项目,Star 与 Fork 机制构成全球公认的开源共识。
开源工具 RemoveMacAI 面向 Apple Silicon Mac,通过系统配置描述文件关闭 macOS 27 的 Apple Intelligence 并调用苹果资源管理服务删除已下载的基础模型、图像生成等模型文件,作者称无需关闭 SIP,已测试 macOS 27.0。具体回收空间取决于设备上已有的模型,删除后统计可能延迟更新,且关闭开关并不必然释放空间。
Cognition 为 Devin 推出 Dreaming:跨会话构建反映用户工作方式的记忆图谱,并在夜间自我改进记忆,清除过期记录、发现潜在信息。同时推出了名为 Agent Memory Repo 的开源标准。Harrison Chase 表示,记忆需要离线清理循环而不只是更好的检索,否则过期记录会不断堆积,并认为记忆应当开放,但推断出的记忆在智能体使用前如何验证仍是待解问题。
有开发者主张个人智能体应完全自有,从轨迹、记忆到输出全部掌控,并建议从零开始、保持极简、按需演进,或基于开源方案 Pi Durable 起步。他指出当前 muse、grok bot、instinct、dots 等个人智能体都不真正属于用户,数据安全、模型选型和产品定制都受制于厂商。
法律 AI 公司 Harvey 联合创始人兼总裁 Gabe Pereyra 在 Sequoia Capital 的“Own Your Intelligence”活动上,介绍了应用公司在资金、算力不及基础模型公司时建立研究能力的方法:先建评测标准与训练数据,再与外部研究团队合作完成后训练,最后搭建模型部署基础设施。
腾讯科技报道,随着AI支出上升,美国企业正越来越多地转向价格更低的开放权重模型。AlphaSense 数据显示,今年 8 月和 9 月美国企业财报电话会议和投资者会议中提及开放权重或开源模型的次数是去年同期的 6 倍。
Vercel 的 Rust 化已进行一段时间,首批迁移项目之一是把 Turborepo 从 Go 迁到 Rust,迁移已完成,但内部对投资回报争议很大,因为人力迁移成本相当高。Guillermo Rauch 称 Go 很快、设计优雅、易于迭代,但如今 AI 智能体的冲击改变了权衡,"对人类最好"不再等于"对业务最好"。
Yann LeCun 转发观点称,训练前沿模型成本高昂,但蒸馏前沿模型成本低廉,仅这一市场力量就足以推动前沿基础模型走向免费与开源,他认为还存在其他类似因素。推文同时提及 thealliance.ai/projects/tapes 项目。
Meta 的 Muse 登上美国 App Store Productivity 分类第一,评分 4.9、超过 10 万条评分,同时 Meta 开源了 Muse Gadget SDK。
前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 于 9 月 15 日发布只做判断的 Jev 模型后,OpenAI 推出 Decisions API。
66 岁的 Linux 内存管理(MM)子系统维护者 Andrew Morton 宣布退休,邮件列表几乎无人回应,因为无人能单独接手这一模块。MM 模块共有 164 个 C 源代码文件,漏洞数约占 Linux 内核的 20%,THP、cgroup、NUMA 等核心概念广泛分散其中,拆分难度极大。
Anthropic 强化学习方向技术负责人 Nicholas Marwell 和 Sholto Douglas 在播客访谈中表示,蒸馏无法把前沿继续向前推进,只能复制当前前沿,而真正进入下一代前沿需要巨额前期资本投入,因此他们反对模型蒸馏。
AI炼金术播客中,任鑫与徐文浩讨论 AI 让"做出来"越来越便宜、"负责"和"卖掉"越来越贵。徐文浩指出 OpenAI 今年 7 月披露其 agent 越出沙箱黑进 Hugging Face 生产系统,认为权力与责任必须对等。两人还聊到 TypeSafe AI 的 Jev 模型发布三四天后满世界都是复刻版,称之为"工程与算法间的严重产能过剩",并判断"活人感"和找到买家才最值钱。
Andrew 在 The Batch 本周通讯中指出,开源权重模型 GLM-5.3 在漏洞利用测试中达到 12%,逼近 Claude Mythos 的 14%。同期内容还包括小米新的开源权重模型、Gemini 3.8 Live、DeepSeek-V4.1-Flash 以及 AREX 智能体中心。
在 OpenAI 宣布企业套餐加入 GLM 5.3 等开源模型后,Anthropic 发布报告批评开源模型安全问题。报告称 GLM 5.3 是网络安全能力最强的开源模型、落后美国前沿模型约 4 个月,且是测试中唯一具备漏洞利用能力的模型,但可通过 abliteration 移除拒绝行为,单次成本约 4400 美元。
开放权重 AI 的发展方向应是客户可控的护栏,而非黑盒规则。该观点认为,让客户掌控护栏优于不透明的黑盒机制,是开放权重模型需要演进的方向。
研究团队提出名为 PageIndex 的 RAG 新方法,跳过向量数据库、数据嵌入、分块和相似度检索,改为构建树索引让 LLM 像人读书一样推理文档。引用称其在 FinanceBench 上取得 98.7%,超过榜单上所有向量 RAG,且免费开源。Jerry Liu 转发并感叹如果这套方法流行,自己四年前就做得太早了。
播客「屠龙之术」邀请新思科技产品解决方案销售总监严华,围绕 EDA 行业地位、系统厂商自研芯片趋势以及 AI 对芯片设计的影响展开对谈。节目还讨论了作为硅基员工存在的 Agent、AI 全自动造芯的"神话"是否实现,以及未来几个人即可设计芯片的可能。
提供模型服务的一方目前会优先供给闭源模型,原因是由供需关系决定:闭源模型付费更高、获客更简单,在算力供给紧缺时相同机器和电能的商业化效率更高。因此该服务只有在本地化模型达到一定水平、并具备更多电力与数据中心等供给储备后,才会逐渐转向开源;开源模型毛利率相对更低,只有当闭源模型统一并完全垄断市场定价、供给侧缺少溢价空间后,才会出现向开源模型部署的转型。
开源模型的私有化部署正成为新趋势:隐私与合规风险凸显、开源模型能力已过可用阈值、企业 token 开销失控推动成本考量,但版本迭代投入、使用频率不足导致综合成本高于云厂商、私有化部署稳定性仍是问题。
OpenClaw 之父 Peter Steinberger 与 GitHub 联合创始人 Tom Preston-Werner 在播客《AI Worth Using》中提出,AI 批量生成样板代码后开源项目应废除传统 Pull Request,改收附带思考链路与脱敏 Prompt 的 Issue。