模型开放之后,AI 能力为什么仍难以复用?
AI 开源的价值正从"开放了什么"转向"开放的能力能否被验证、复用和持续迭代"。2026 年世界人工智能开源大赛(GOAI)覆盖 91 个国家和地区、吸引超 1.4 万名开发者,收到 2999 份有效初赛作品,70 个项目进入总决赛,多 Agent 协作与 Skill 调用成为工程考察重点。
AI 开源的价值正从"开放了什么"转向"开放的能力能否被验证、复用和持续迭代"。2026 年世界人工智能开源大赛(GOAI)覆盖 91 个国家和地区、吸引超 1.4 万名开发者,收到 2999 份有效初赛作品,70 个项目进入总决赛,多 Agent 协作与 Skill 调用成为工程考察重点。
国产操作系统已有银河麒麟、统信UOS、deepin、openEuler、龙蜥Anolis、鸿蒙PC等数十个发行版,但底层几乎都是Linux。
技嘉 10 月 9 日宣布,全部 B760 和 H610 主板将通过 BIOS 更新支持预计 2027 年初推出的新款英特尔 LGA1700 处理器,其中包含 DDR4 主板。
开源项目 REA(Reverse Engineer Anything)把逆向分析工具接到了 Claude Code、Codex、Cursor 这类 AI 编程智能体上。
OpenAI 于 10 月 7 日一次性公开 722 篇数学手稿,论文和部分 Lean 证明上传 GitHub,作者栏均署 OpenAI。其中编号 074 的两篇分别声称证明三维挂谷极大函数猜想和四维挂谷集的 Hausdorff 维数猜想,后者把此前卡在 3 点几的维数下界直接推到 4,两篇共 272 页,四维论文还引用了三维论文中的引理。
有人整理了 34 个适合 Vibe Coding 使用的中、英文字体,均为免费开源并已核查授权文件要求。这批字体支持通过 JS 直接引用,下载地址已在 GitHub 公开。
Mistral 推出 Le Chonk,加入西方开源模型竞赛;OpenAI 的数学成果持续爆发,已发布 700 多篇论文。GPT-6 Astra 现可帮用户直接比较不同网站,Brett Adcock 的 Hark 则推出主动型 AI 助手。
LangChain 发布 LangSmith Fine-Tuning 和 smithtune,这是一个把 LangSmith 轨迹转成 Agent 专用微调模型的 CLI,覆盖数据集构建、基于 Fireworks 或 Baseten 的训练以及 LangSmith 评估。
Cloudflare 收购 Deno 整个团队,Deno 运行时仅再维护一年,Deno Deploy 六个月后关闭,JSR 由 Cloudflare 承接。Cactus 发布 16.9 MB 的本地语音识别模型 Whistle,CPU 运行,支持七种语言并输出词级时间戳,每次最多处理 30 秒音频,暂不支持中文。
据《日经亚洲》报道,苹果要求部分供应商将 iPhone 18 Pro 和 Pro Max 零部件订单较最初要求减少至少 15%,供应链人士称降幅约 15% 至 20%,但另有供应链人士称 Pro 订单被调整至 Pro Max,整体总量没有减少。
Armadin Security 创始研究员 Yonatan Oren 分享了其团队如何在 Fireworks Forge 上后训练开源模型,用于监控生产环境中的安全智能体。相关分享将于 11 月 3 日在旧金山举行。
宝玉将文章中的开发方法论完整应用于开源项目 baocut,流程涵盖技术方案文档、原型与 UI 设计、编码实现和测试验收。他让 Agent 先做调研并撰写技术方案文档,反复沟通定稿后再产出接近正式 UI 的高保真原型,最后才实现代码。验收阶段 Agent 借助 Electron 的浏览器能力自行测试,多数活由 Agent 完成,人只负责定义问题和验收。
Cloudflare 发布 Clef-omni,在文本和图像之外新增音频(wav/mp3)与视频(mp4/webm)输入,基于 Qwen3-Omni-30B-A3B-Instruct MoE 构建并已在 Hugging Face 开放权重,定价为每百万输入 token 0.15 美元。
Simon Willison 征询适合编程、能在 60GB 内存以内运行的开源权重 MoE 大模型,认为 MoE 是其可用硬件上达到可交互速度的必要条件,目标是超过 12 tokens/秒。
Anthropic 启动长期项目 Cyber Mission,并推出免费的 OSS AI 扫描器,定期检查开源项目、自动标记并解释漏洞、给出补丁建议;其关键基础设施防御计划(CIDP)向电网。
2026 年 9 月 GitHub 十大热门项目榜单从约 23 个候选中选出 ponytail、ECC、open-code-review、hindsight、WeKnora、cua 等十个项目,覆盖编码 Skill、Agent Harness、代码评审、Agent Memory、知识 RAG 与 Computer-Use 等方向。
深圳公司 DiffuSpace 连续完成两轮融资,总金额数亿元人民币,创下全球扩散语言模型(dLLM)最大规模融资纪录,由经纬创投、顺为资本、君联资本联合领投,中科创星、华为哈勃、地平线等跟投。
Deno 团队整体加入 Cloudflare。接下来一年 Deno 运行时每月发一个版本,只修 bug 和安全问题,一年后官方停止开发;托管平台 Deno Deploy 再运行六个月关闭。
LangSmith Signals 上月数据显示,Claude Sonnet 5 的模型采用率从第 9 升至第 2,使用它的组织增加了 51%;gpt 5.6 luna 的调用足迹从第 3 升至第 1,调用量增长 65%。两款开源权重模型首次进入采用率前十,但调用量未进前列,调用足迹仍由更小更快的模型主导。
Hugging Face 旗下 Pollen Robotics 设计的机器鸭 Microduck 售价 399 美元,高峰期平均每 4 秒卖出一台,五天后预售破万台、销售额突破 500 万美元,由潘昊创办的深圳 Seeed Studio 矽递科技代工。
GitHub 将 GitHub Copilot CLI、Copilot 应用和 Copilot SDK 背后的运行时从 TypeScript 和 Node.js 迁移到 Rust,通过 AI 辅助重写替换了超过 80 万行生产代码。
阿里 Qwen 团队发布 Qwen-Image-2.1-Turbo,称只需 8 个去噪步骤即可生成和编辑图像,并已开放权重。该模型基于 Qwen-Image-2.1,是在同一 7B 视觉生成架构上的加速检查点,官方称仍能由文本生成 2K 图像,并支持通过自然语言编辑继续创作,例如添加配饰或更换场景。
Deno 官方宣布加入 Cloudflare,作者转述称 Deno Runtime 在维护一年后将停止。作者认为 Cloudflare 正把 Astro、VoidZero 等整条 JS 链路收进自己平台,并感叹 AI 兴起后框架之争已淡出。
10月9日,扩散智能DiffuSpace宣布已连续完成两轮融资,由经纬创投、顺为资本、君联资本联合领投,中科创星、华为哈勃、地平线等跟投,总金额达数亿元。DiffuSpace于2026年5月在深圳成立,团队研发的Dream 7B扩散语言模型部分能力可比肩DeepSeek V3(671B),目前正在训练新一代更大参数规模的模型并计划近期开源。
AutoTrust AI Lab 开源基于 Qwen3.8-27B 的多模态决策模型 JEV-27B-VL,融合 System 1 快速决策与 System 2 深度推理,可视为能“看见”的 JEV-27B。
OpenViking 团队围绕 Agent 的上下文管理发布三项研究:VikingMem(VLDB 收录)把记忆分为事件与实体两层并维护最新档案,在 LoCoMo 长期记忆评测上得 88.83。
袋鼠帝实测了 Vidu 上线的新一代视频旗舰模型首个预览版 Vidu Q4 Preview,并用它复刻《你的名字》真人版最后一幕、用五种情绪演绎同一句台词。据其介绍,该模型主打传神表现力,支持最多 3 段参考音频和 15 张参考图,可直出 720P、1080P、2K、4K,单次最长 16 秒,首发 0.09 元/秒起。
星动纪元(清华唯一持股的具身公司)推出世界动作模型 VPP2(Video Prediction Policy 2),以平均成功率 32.26%、平均得分 39.26 登顶 RoboDojo 榜首,超过此前 GPT-6-Astra 的 22.48% 和 28.97%,并拿下 generalization、precision、memory 三项第一。
Opus 5.5 发布并被指代码能力再次飞跃,深度和广度已超越 99% 的程序员,完成同样任务所需生成的代码输出反而更少。有开发者用它直接反编译二进制、几十分钟做出可玩游戏 demo,也有人靠 AI 重写代码绕开 GPL 传染;Muse 为 ESP32 提供 Agent Ready 通用固件,模型推理成本最近一周大幅下降,Strata 可把推理速度提升数倍。
OpenAI公布了一批由内部前沿模型产出的数学研究成果,包括722份数学手稿和372组相关成果,覆盖数论、代数几何、实分析、组合数学、理论计算机、数学物理、偏微分方程等多个方向。部分成果附有可由计算机核验的Lean形式化证明,社区初步核查发现其中涉及多个长期未解的开放问题,但具体结论仍需数学界进一步审阅与验证。OpenAI表示,AI正在从辅助解题走向参与真正的数学研究与发现。
微软开源 Agent Lightning v1.0,一套面向 AI Agent 的强化学习框架,让开发者保留现有工具调用、上下文管理和任务执行流程,用实际任务反馈训练底层模型。
阿里云智能集团副总裁安筱鹏在2026云栖大会汽车行业峰会上提出,AI正同步重构汽车产业的经济模型、产品形态与竞争规则,使行业呈现高固定成本、低边际成本特征。全球汽车产业利润池中传统业务占比将从2021年的90%降至2035年的44%,Robotaxi市场年复合增长率超88%,2035年规模达1300亿~4150亿美元。自动驾驶、智能座舱、AI生产力由此成为三大竞技场。
前 Square 工程师 Brandon Thomas 带四人团队借助 Claude Opus 5.5,用 Rust 开发了 ArtCraft 套件中的 7 款开源应用。
AI Agent 创企 Nous Research 完成 9000 万美元 B 轮融资,估值达 15 亿美元,由 Robot Ventures 领投,Nvidia、Union Square Ventures、Menlo Ventures、Samsung 及 1789 Capital 参投,累计融资 1.58 亿美元。
作者用一段提示词让 Grok Bot 每天早上 9 点整理前一天 AI 资讯,并试做出约 90 秒的中文讲解视频,采集、写代码和渲染全部跑在它的云端虚拟机上。
Qdrant 推出新的 memory store 集成,可作为 LangGraph 长期记忆的存储层,让 AI 智能体跨会话保存并召回信息。该集成把 Qdrant 的向量原生存储与语义搜索带入 LangGraph 记忆系统,智能体可按语义而非精确匹配检索相关记忆,用于存放用户偏好、过往交互等上下文。
Valkey 创始开发者 Madelyn Olson 与 Viktor Söderqvist 在 OSS EU 上介绍了项目进展:8.x 的异步 I/O 线程将单进程吞吐从约 20 万-25 万请求/秒提升到约 100 万,并加入键嵌入与双通道复制;9 版带来原子槽迁移、编号数据库和哈希字段过期。
扩散语言模型公司 DiffuSpace 完成数亿人民币融资,由港大 NLP 实验室联合主管孔令鹏及其博士生龚珊三、叶佳成联合创立,2026 年 5 月落地深圳。其 Dream 7B 模型在数学、代码、规划任务上全面超越同规模自回归模型,部分指标超过 671B 的 DeepSeek V3,Hugging Face 下载量超 250 万。团队正推进新一代更大参数规模模型训练。
由华为2012实验室、华为云等团队联合高校与开发者构建的开源 AI Agent 平台 openJiuwen,发布并开源企业级 AgentOS,将多智能体协同、自演进、算力亲和与企业级安全可靠能力融入统一底座,并通过插件化架构连接上层应用与底层模型、算力资源。
LangSmith 评测中的 Jev 判官把轨迹标注拆成多个问题,难度和正确性各自得到带类型的答案,且在一次 pass 中、对每条 trace 完成。该框架认为轨迹标注需覆盖任务难度、方案正确性、设计选择多样性和思考方向等维度,规模化标注百万级 agent 及其子 agent 的 token 成本仍待大幅降低。