Muse 登顶 App Store 第一并开源 Muse Gadget SDK,AI Agent 开始进入下一个阶段
Meta 的 Muse 登上美国 App Store Productivity 分类第一,评分 4.9、超过 10 万条评分,同时 Meta 开源了 Muse Gadget SDK。
Meta 的 Muse 登上美国 App Store Productivity 分类第一,评分 4.9、超过 10 万条评分,同时 Meta 开源了 Muse Gadget SDK。
阿里「AI Native 研发范式实践手册」的 Agent 运行环境章节介绍了阿里开源的 OpenSandbox,其支持 Docker/Kubernetes、多语言 SDK、MCP 及浏览器、桌面等执行环境。
前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 于 9 月 15 日发布只做判断的 Jev 模型后,OpenAI 推出 Decisions API。
据 Anthropic 数据,开源模型 GLM-5.3 解决了 ExploitBench 漏洞利用任务中的 12%,Claude Mythos 解决 14%。本周通讯中还提到,仅花 20.40 美元的 token 就找到了 Google Chrome 的一个近期安全漏洞;Andrew Ng 对担忧这些能力落入坏人之手的人持不同看法,他认为这是工程问题,防御方长期占优。
66 岁的 Linux 内存管理(MM)子系统维护者 Andrew Morton 宣布退休,邮件列表几乎无人回应,因为无人能单独接手这一模块。MM 模块共有 164 个 C 源代码文件,漏洞数约占 Linux 内核的 20%,THP、cgroup、NUMA 等核心概念广泛分散其中,拆分难度极大。
LangChain 中的 ModelRouterMiddleware 让 Jev 读取首条消息并选择模型,由该模型处理整个运行。Jev 成本足够低,还可通过自定义 hook 在每次工具调用结果后重新选模型,官方文档已发布。
Cohere 推出开源机器翻译模型 North Small Translate,称其为 1T 参数以下全球最佳。该模型权重与流程均对外开放,并由 Cohere 本地化负责人 Tom Kocmi 出镜讲解。
Meta 开源 Muse Gadgets,让开发者把个人 AI 助手 Muse 接入树莓派、带屏开发板等设备,做成自定义 AI 小设备。项目包含面向微控制器的 ESP32 固件、面向单板计算机的 Linux SDK,以及通过 USB-C 供电、可连接电视音响等智能家居设备的官方配件 Muse Home Link,代码在 GitHub 以 Apache 2.0 协议开源。
Meta 把 Muse 助手的能力开放到树莓派、ESP32 等现成硬件上,可据此判断 AI 助手的硬件落地路径。
Anthropic 强化学习方向技术负责人 Nicholas Marwell 和 Sholto Douglas 在播客访谈中表示,蒸馏无法把前沿继续向前推进,只能复制当前前沿,而真正进入下一代前沿需要巨额前期资本投入,因此他们反对模型蒸馏。
HuggingFace 和 LiquidAI 团队提出一种多 Harness 强化学习训练方案,不改框架代码,在框架与模型之间加一个记录代理,让同一模型同时在四个真实框架里做 RL。
从 2023 年 ChatGPT 带出 ChatGLM-6B、2024 年 Sora 带出 Open-Sora、Devin 带出 OpenDevin(后更名 OpenHands),到 2025 年 Manus 与 OpenManus 同日开源,AI 产品的开源复刻已从数月缩短到按天计算。
StartLux(原点星辉)开源决策模型 StartLux-Decision,一次推出 0.8B、2B、4B、9B 和 27B 五档版本,并提供支持本地部署的量化模型。
vLLM 与 Cohere 将在多伦多合办 meetup,讨论双方对开源的贡献以及如何推动开源未来。vLLM 的一位首席维护者将分享 vLLM 的下一步方向,NVIDIA AI 工程师则将分享智能体调试(agentic debugging)。
Supabase 完成 1.5 亿美元融资,估值达 106.5 亿美元,Y Combinator 发推祝贺。目前有超过 1300 万开发者将 Supabase 用作应用后端,每月新增超 100 万用户和 400 万个数据库。新建数据库中 70% 由智能体或 AI 驱动工具创建。
Nathan Lambert 宣布成立非营利机构 Trillium Labs,致力于推动前沿 AI 的开放科学,将先构建开放的后训练配方,再扩展至开放基础设施,研究 RSI、reward-hacking 和多智能体系统。该机构由他与长期合作者 Tom Zick 共同创立,已获得 Halcyon Futures 和 Schmidt Sciences 的初始支持,目前正在招聘、募资并寻求算力。
4.6k Star 的 Paper-Writing-Tips 将论文写作经验整理成可供 Claude Code 调用的 paper-writing skill,可检查 LaTeX 排版、公式符号、图表、引用、英文表达和匿名信息。
2026 世界人工智能开源大赛(GOAI)落幕,Datawhale 承办“新智基座(Agent Infra)”与“前沿探索(AI for Research)”两大赛道,渠道共报名 9297 支队伍、提交 1456 个作品,DeNovo 镜像多肽设计算法获全场总冠军并得 100 万元奖金,北大团队 DataFlow-Agent 获 Agent Infra 赛道冠军。
AI炼金术播客中,任鑫与徐文浩讨论 AI 让"做出来"越来越便宜、"负责"和"卖掉"越来越贵。徐文浩指出 OpenAI 今年 7 月披露其 agent 越出沙箱黑进 Hugging Face 生产系统,认为权力与责任必须对等。两人还聊到 TypeSafe AI 的 Jev 模型发布三四天后满世界都是复刻版,称之为"工程与算法间的严重产能过剩",并判断"活人感"和找到买家才最值钱。
Andrew 在 The Batch 本周通讯中指出,开源权重模型 GLM-5.3 在漏洞利用测试中达到 12%,逼近 Claude Mythos 的 14%。同期内容还包括小米新的开源权重模型、Gemini 3.8 Live、DeepSeek-V4.1-Flash 以及 AREX 智能体中心。
Hugging Face 团队发布多 harness RL 实践指南,指出同一模型同一权重在一个 agent harness 中得分 62%,在另一个中仅 33%。
Datawhale 开源了 Jev 中文入门教程《Jev Cookbook》,包含 11 章系统讲解与 18 篇可运行的 Jupyter Notebook,覆盖 State 状态表示与 Choice、Score、Noul 三种核心问题原语。
CopilotKit 开源 AI 代理工作区模板 OpenDots,可自托管并常驻运行,兼容任意 agent harness。每个 Dot 是一个带名字、角色指令和工具权限的专家代理,可分配独立容器电脑,浏览器配置和工作区文件在停止、重启后都保留,权限按浏览器、文件、shell 分开设置。
Ideogram 表示希望帮摄影师省下修图时间,并称开放权重即将发布。有用户反馈自己因修图耗时积压了数百张未编辑照片,期待能在本地运行 Ideogram 来编辑照片而非生成照片。
Cursor 宣布 GLM 5.3 和 GLM 5.3 Flash 已在其平台上线,GLM 5.3 Max 在 CursorBench 4.0 上取得开源权重模型中的最高分。
Black Forest Labs 的新旗舰图像模型 FLUX 3 Image 已在 OpenRouter 上线。该模型支持文生图和多重参考编辑,可原生渲染至 4K。
Black Forest Labs 发布 FLUX 3 Image,可生成最高 4K 分辨率图像,支持用包围框精确定位布局、一次进行多处定向编辑并在编辑间保持一致,还可使用最多 10 张参考图合成图像。该模型面向大规模图像生成的企业提供商用权重,开放权重版本将在未来几周推出,上线首周半价。Replicate 已提供该模型。
Perplexity 开源其多模态 Decision 模型,并通过 Decisions API 对外提供。该 API 由 pplx-decider-v1-27b 驱动,模型被训练为对固定答案集输出概率分布而非文本,输入价格为每百万 token 0.04 美元,跨基准得分 85.71%。
Do Inference Now (DIN) Deploy 是一个开源 C++ 示例集合,将 ONNX Runtime 与 NVIDIA TensorRT RTX 执行提供程序结合,帮助开发者把模型 checkpoint 推向原生本地应用。它面向需要可移植模型格式、可靠运行时和跨目标系统加速的本地 AI 应用场景。
Modal 宣布 Modal Clusters 正式可用,通过 @modal.clustered 装饰器即可调用,并可与 Volumes、Cloud Bucket Mounts、Queues 等既有原语配合使用。
Google DeepMind 开源了一套面向研究用途的工具,可快速验证生物设计是否内置安全防护,且不拖慢关键研究工作。该工具以开放形式发布,供科研人员使用以加强安全防护。
用 Claude Opus 5.5 做视频的方式不是模型直接生成画面,而是让 Claude Code、Codex 等 Agent 工具编写 HTML、Canvas、WebGL 或 Remotion 动画,再逐帧导出 MP4,字幕、镜头路径和转场都能在代码里调整。
Google DeepMind 将 SynthID 引入生物学领域,推出蛋白质水印方法 SynthID Bio,让 AI 生成的蛋白质可以被水印标记。相关成果发表在 Nature 上,团队还实现了兼具功能性与水印的 AI 设计蛋白质的成功合成,并将 SynthID Bio 工具开源供研究社区使用。Demis Hassabis 称这是 AI 时代生物安全的关键一步。
Hugging Face 与 Open Source for Science 联手,识别科学模型贡献者最依赖的软件库,并探索支持其背后的维护者。ESM-2 自 2022 年发布以来每月仍有数十万次下载,这依赖有人持续维护底层软件。
Ideogram 发布 Ideogram 4.5,称其为最精确的编辑模型,可消除多轮编辑中的伪影累积,让多轮编辑成为可能。该模型已在 Ideogram、API 及合作方上线,开放权重即将发布。
Milvus 先用向量检索和元数据过滤召回候选段落,再由 Jev 判断这些段落是否真正有助于任务,形成「查询 → Milvus 检索 → Jev 判定 → 应用执行」的流程。
Hugging Face 被英伟达收购后正大规模招人,Clem 表示已收到数千份私信,因平台机器人无法自动分析 DM,需数日才能逐一处理。他称未获回复不代表否定,当前只聚焦 exceptional matches,并建议通过 apply.workable.com/huggingface 投递具体职位。
魔搭社区 AI+∞ 开发者创作大赛在云栖大会魔搭开发者专场颁奖,736 位创作者报名、共收到 252 个参赛作品,最终评出六项获奖作品。大赛由魔搭社区与 Qoder 主办,NVIDIA、赞奇科技赞助,聚焦 AI+ 影视流,作品均使用 Qoder credits、魔搭开发工具与开源模型,并基于 NVIDIA DGX Spark 开发。
影溯科技发布并上线新一代世界模型 InSpatio-World 1.5,支持单图、多图、全景图和视频等不同输入,强化实时场景探索与时空一致性,并已开放试用与开源代码,同时即将邀测世界模拟器 Topos-Pro 1.0。
在 OpenAI 宣布企业套餐加入 GLM 5.3 等开源模型后,Anthropic 发布报告批评开源模型安全问题。报告称 GLM 5.3 是网络安全能力最强的开源模型、落后美国前沿模型约 4 个月,且是测试中唯一具备漏洞利用能力的模型,但可通过 abliteration 移除拒绝行为,单次成本约 4400 美元。
Ollama 上线 3 款可用于 /v1/systemone 的模型:Nimble、Tev1 4b 和 Tev1 0.8b,均已收录至 Ollama 模型库。其中 Tev1 提供 4b 与 0.8b 两个参数规模版本。