openJiuwen 发布并开源企业级 AgentOS
由华为2012实验室、华为云等团队联合高校与开发者构建的开源 AI Agent 平台 openJiuwen,发布并开源企业级 AgentOS,将多智能体协同、自演进、算力亲和与企业级安全可靠能力融入统一底座,并通过插件化架构连接上层应用与底层模型、算力资源。
由华为2012实验室、华为云等团队联合高校与开发者构建的开源 AI Agent 平台 openJiuwen,发布并开源企业级 AgentOS,将多智能体协同、自演进、算力亲和与企业级安全可靠能力融入统一底座,并通过插件化架构连接上层应用与底层模型、算力资源。
LangSmith evals 中的 Jev 裁判不再用单一通过/失败判定轨迹,而是在每次 trace 上单次遍历分别给出难度与正确性的类型化答案。Vaibhav Tulsyan 指出,规模化轨迹标注需评估任务难度、agent 方案是否正确、设计选择是否多样、思考方向是否正确等多个维度,因此标注的 token 成本必须大幅降低才能支撑数百万 agent 及其数十到数百个子 agent 的场景。
一套自写的投资辅助系统接入日常流程 85 天,账户浮盈最高到过 3,733 元(2026-08-27),对应约 +10.5%,83 个日度快照浮盈无一为负,最新统计为 1,590 元。系统每月生成定投建议、每日做风险扫描并推送飞书消息,但只给建议,不接券商、不自动下单、不动资金。10 月 7 日风险扫描以执行冻结、现金低于 10,000 元底线等四条理由,把当月定投建议算成 0 元。
余一(Ameliayu)已从鹅厂离职并加入 Manus,她称离开是因为"一些很有意思的事情正在发生"。她此前曾参与线上直播聊 GEO,接下来还将作为分享嘉宾出席 11 月的深圳 GEO 大会。
深圳鲲为科技完成 4 亿元新一轮融资,新增股东 XVC、红杉中国,老股东夏尔巴、腾讯加仓。鲲为通过将深度神经网络引入低频超声回波信号处理,实现穿透颅骨后毫秒级实时捕捉脑组织结构与血流动态。公司已实现数千万订单,并推出基础软件平台 kOS,目标客户为脑机接口 Lab 与 NeuroAI 模型公司。
Product Hunt CEO 基于每周观察数百款产品发布的经验,给出对 2027 年的四个预测:多人协作 Agent 将在编程与非编程场景迎来重大突破,一款新的消费级社交应用将真正突围,"手工软件"即精心打造且完全不使用 AI 的应用将形成一个细分市场,多个硬科技领域也将取得重大突破。
Product Hunt CEO Rajiv Ayyangar 给出 2027 年预测:编码与非编码的多智能体(multiplayer agents)将迎来一次跃升,还会跑出一款新的消费社交应用。他同时预计将出现"手工软件"细分市场,即完全不使用 AI、精心打磨的应用,硬科技多个领域也将有重大突破。
Muse 开始出现在 Rabbit R1 上,已有用户动手尝试并放出实际运行演示。该演示由 G Cam Pak(@CameronPak)发布,帖内含运行视频。
有人把 Nikita Bier 的消费级应用方法论做成了一个面向所有人的免费开源 AI Skill。用户只需向 Agent 描述自己的应用,它就会判断应用卡在增长阶梯的哪一层、指出哪些数据暂时不能相信、给出应先修复的项和 2–3 个重点押注方向,并设计一项测试、在运行前设定明确的是/否门槛。Nikita Bier 本人的咨询费为每分钟 500 美元,且只接受获得 VC 投资的创始人预约。
Tibo 将 Nikita Bier 的消费者应用方法论整理成一个免费开源的 AI 技能,用户向 agent 描述自己的应用后,它会指出你卡在增长阶梯的哪一级、哪些数据还不可信、该先修什么以及 2-3 个重点押注,并给出一个预设 yes/no 阈值的测试。该技能将出现在明天的 newsletter 中。
a16z 的 Raghu Raghuram 与 AWS CEO Matt Garman 对谈,主题是全球最大云厂商为智能体时代重建:2026 年 CapEx 达 220B 美元,已订购两百万块 NVIDIA GPU,AWS 自研 AI 芯片到明年售罄,并推出无需信用卡的 30 秒 AWS 账号。
Google 发布实验性游戏平台 Playground,用户通过对话界面输入提示词即可创建、游玩和分享自定义游戏,无需编程经验,可在浏览器中用手机或笔记本游玩并支持排行榜和部分品类的多人模式。Playground 今日面向美国 18 岁以上用户开放,创建权限按 Google AI 订阅分档;未来将接入正在测试的 Unity Spark,提供专业级机制和高保真 3D 能力。
阶跃星辰(StepFun)的新旗舰模型 Step 5 Preview 已在 OpenRouter 上线,面向智能体任务,采用稀疏 MoE 架构,激活参数 27B、总参数 600B,支持 1M 上下文窗口及文本、图像、视频输入。该模型在编程和专业知识的任务上表现强劲,尤其在金融领域。
StepFun 的 8 项基准评测显示,Step 5 Preview 在 6 项上超过 Kimi K3 和 GLM-5.3,包括 DeepSWE(67.7)、ProgramBench(80.5)、StepCodeBench(49.0)和 FrontierFinance(66.4)。
StepFun 的 Step 5 Preview 已在 OpenRouter 上线,输入 $1.00/M、输出 $2.70/M,缓存命中在发布期 50% 折扣后为 $0.05/M,面向智能体与专业工作场景。该模型将在 opencode、cline、NousResearch、kilocode 等渠道提供一周免费访问。
5 人销售团队用 OpenRouter 的 Ori 搭建了 AI 销售智能体 Rasp,每条入站线索都会被调研,不少线索能在 60 秒内收到回复,每月省下约 600 小时。成本约每天 30 美元,且每周都在变便宜。
Paul Graham 表示,与 Amjad 交谈后意识到 Replit 比他此前认为的更重要,因为它代表着 AI 渗透组织的方式。他认为组织可以通过使用 AI 驱动的应用在一定程度上与 AI 对齐,但最深层的改变以代码的形式出现。
Spring AI Alibaba 最后一个正式版 v1.1.2.2 发布于 2026 年 3 月 10 日,此后半年无新正式版,但 main 分支仍有提交,8 月 25 日还有最新 commit,v1.1.2.2 之后共合并 137 个提交,以修复和测试为主。
Paul Graham 表示,与 Amjad 交谈后他意识到 Replit 比此前认为的更重要。组织可以通过使用 AI 驱动的应用与 AI 保持一定程度的契合,但最深层的变革以代码的形式发生。
Paul Graham 认为,亚马逊封禁 AI 智能体的做法,为创业公司创造了自亚马逊创立以来首个打造其竞争者的机会。他指出,用户会希望由 AI 智能体替自己购物,这将成为智能体的主要用例之一,而用户不会愿意使用亚马逊自家的智能体来完成这件事。
GitHub 正在为 GitHub Copilot 引入本地模型与沙箱化工具,让开发者在使用这些能力时对工作流保有选择权与控制权。该消息由 GitHub 官方账号发布,但未披露支持的具体模型、工具清单或上线时间。
OpenAI Developers 发文回顾社区基于 modretro Chromatic 的创作,并采访 @Casey 聊创造力的未来;该开发者已把一个想法做成可在 modretro 上玩的游戏。
Prime-Sentinel Command(PSC)是一个用 Python 面向对象实现的 master-agent 架构,由中央编排器 PrimeProgram 协调多个自主边缘诊断节点 SentinelProgram,后者采集 CPU 负载、内存占用与网络状态并返回结构化遥测数据。
Varun Jindal 提出在模型之外为编码智能体搭建一套 harness,包含宪法、自主边界、分层上下文、持久记忆、多视角评审面板和编辑后钩子六个部件。
Stack Overflow 博客发布六层 LLM 生产系统成熟度模型的第一层「确定性层」,主张智能体应是从上下文到提案的纯函数,无权直接改变业务状态,由经过充分测试的 substrate 在审批后执行提案。
Stack Overflow 博客发布了一份生产级 LLM 与智能体实战指南,提出从 Notebook 演示到生产级构建的六级成熟度模型,涵盖确定性、评测、置信度、安全治理与运维等层次。文中给出可勾选的自检清单,例如智能体只能提出建议而非直接改动业务状态、提示词或模型变更导致质量回退时应使 CI 失败、敏感数据在边界处脱敏并采用只追加审计账本。作者建议团队先找到自己最弱的一层,再按顺序逐级补齐。
Datadog 是面向云应用的可观测性与安全平台,可对基础设施、分布式系统以及 AI 智能体行为进行实时监控。该平台此次聚焦如何查看 AI 智能体的内部运行状态。
Oracle 的 Richmond Alake 将于 10 月 13 日在 AI Engineer New York 发表演讲,主题是智能体如何理解业务上下文、权限与记忆——即智能体能写出查询,却未必知道分析师被允许看到什么。Oracle AI Database 是本次活动的 Platinum 赞助商。
Exa 的 Ryan Ahern 将于 10 月 12 日在 AI Engineer New York 带来回测主题分享,聚焦智能体是否"偷看"了未来信息导致回测结果失真。活动同期可用 Exa Snapshot 检索"昨天的网络",Exa 是本次大会的 Platinum 赞助商,工作坊需另行购买。
WorkOS 的 Isabelle Williams 将在 AI Engineer New York 演讲,主题是 AI 智能体的身份与权限撤销。议题聚焦当智能体代表他人发现 API 并注册后,其权限归属问题。活动于 10 月 13 日举行,WorkOS 是白金赞助商。
马斯克表示,Grok Bot 今后会针对具体任务选用最合适的后端模型,不再局限于 Grok 4.7 或 4.6,也会调用 Claude Opus 5.5、Midjourney、Suno 以及其他领先 API,以求给出最好的结果。转述该消息的博主认为,Grok Bot 将借此具备构建内容和执行任务的能力。
马斯克表示 Grok bot 会根据特定任务调用当前最佳模型,不再局限于 Grok 4.7 或 4.6,还会通过 Opus 5.5、Midjourney、Suno 等 API 帮用户构建内容或执行任务。
Anthropic 宣布为 Max 和 Team 套餐用户按月发放 Claude Platform API 额度:Max 5x 为 100 美元,Max 20x 为 200 美元,Team 最高 500 美元且可共享池化。该额度可用于任何模型,包括 Haiku 5.5,既能在自己代码中使用,也能在支持输入 API 的第三方工具中使用,完整条款见 support.claude.com。
歸藏(guizang.ai)称,当时为抢 99 美元的额度用另一个账号购买了 Gork Bot,结果现在用自己的 Twitter 账号 @它,它不回。他同时提到 Grok bot 最近可搜索、阅读甚至监控指定推特内容,例如让它在 tibo 重置 Codex 额度时通知你,且这些功能免费、不通过以前的 xapi 实现。
用户用一段提示词让 Grok bot 每天早上定时产出 AI 早报视频,内容收集、写代码和视频渲染全部跑在 Grok 的云端虚拟机上,不占用本地电脑。提示词可直接复制,让其他人的 Grok bot 执行同样的任务。
歸藏让 Grok bot 每天早上定时产出一条 AI 早报视频,内容收集、写代码和视频渲染全程都在其云端虚拟机上完成,未动用本地电脑。他分享的提示词可直接复制,让其他 Grok bot 也能执行同样的任务,Muse、Dots 等带云端电脑的 Agent 同样适用。
用户可以直接 @ 自己的 bot,把它加入到每日任务里。这条内容来自歸藏(guizang.ai),互动数据为 1 条回复、1 次转发、4 个点赞、6759 次浏览,由 xgo.ing 提供支持。
歸藏用 Grok Bot 每天早上定时生成 AI 早报视频,内容收集、写代码和视频渲染全部跑在其云端虚拟机上,未使用本地电脑。他分享了一段提示词,复制后其他 Grok Bot 也能执行同样的任务,并称复杂任务效果巨好。
一种做法是在 Agent 的云电脑里安装 Pi 或 DeepSeek Harness 这类编程 Agent,并把其他 Code plan 用不完的额度配置进去。之后由 Grok Bot 调用这些 token 来写代码、渲染视频,让闲置额度不被浪费。
歸藏(guizang.ai)分享一种用法:在 Agent 的云电脑里安装 Pi 或 DeepSeek Harness 这类编程 Agent,把其他 Code plan 用不完的额度配置进去,再让 Grok Bot 调用这些 token 写代码、渲染视频。他称这样闲置额度就不会浪费。