模力工场联合 InfoQ 等举办 1024 AI 社区日,10 月 24 日杭州开启报名
模力工场联合极客邦科技旗下 InfoQ、极客时间、AI 原住民、OPC 举办的 1024 AI 社区日将于 2026 年 10 月 24 日在杭州云谷中心举行,首批报名已开启。
模力工场联合极客邦科技旗下 InfoQ、极客时间、AI 原住民、OPC 举办的 1024 AI 社区日将于 2026 年 10 月 24 日在杭州云谷中心举行,首批报名已开启。
快手技术专家祁慧在 AICon 2026 深圳站分享了分销增长 Agent 的实践,将 AI 经营能力从单点工具演进为主从结构的 Multi-Agent 经营大脑:主 Agent 负责全局诊断与规划,选品、定价、建联等子 Agent 独立执行并回传结果。团队同步搭建数据智能基建,通过沉淀经营知识库、商达合作知识图谱、Skill 接口与商家经营画像,并对小模型做 GRPO 微调以降低成本与响应时延。
OpenAI 于 10 月 8 日在 Responses API 中为 GPT-6.1 Sol 增加 Ultrafast 极速模式,向所有 API 用户开放,开发者无需更换模型名,只需将服务档位设为 ultrafast。
TRAE 将 TraeWork 和 TraeCode 双端合并为全新 TRAE,新增 Agent 模式,可在同一窗口管理所有项目、调度多个 Agent,需要深入代码时一键切回 IDE 修改同一工程。
微软开源 Agent Lightning v1.0,一套面向 AI Agent 的强化学习框架,让开发者保留现有工具调用、上下文管理和任务执行流程,用实际任务反馈训练底层模型。
阿里云智能集团副总裁安筱鹏在2026云栖大会汽车行业峰会上提出,AI正同步重构汽车产业的经济模型、产品形态与竞争规则,使行业呈现高固定成本、低边际成本特征。全球汽车产业利润池中传统业务占比将从2021年的90%降至2035年的44%,Robotaxi市场年复合增长率超88%,2035年规模达1300亿~4150亿美元。自动驾驶、智能座舱、AI生产力由此成为三大竞技场。
谷歌下一代模型 Gemini 4 Argon 尚未官宣,已被曝密集现身多个平台,最快将于本周甚至数小时内发布。爆料称其发布卡片已上线谷歌内部系统及部分 Pro 用户界面,并已进入 Google Cloud 控制台,在编程工具 Antigravity 中被设为默认模型,还出现了真实的代码提交记录。
前 Square 工程师 Brandon Thomas 带四人团队借助 Claude Opus 5.5,用 Rust 开发了 ArtCraft 套件中的 7 款开源应用。
Sumus 正式上线 Generative UI,其 AI 智能体现在可以在对话中直接给出可交互工具,用于对比房源、调整数字和规划下一次补货,入口为 sumus.im。
Anthropic 工程师 Thariq Shihipar 在播客中谈 Claude Code,认为 Agent 写代码已成许多人的默认方式,真正拉开差距的是能否把需求讲清楚。
AI Agent 创企 Nous Research 完成 9000 万美元 B 轮融资,估值达 15 亿美元,由 Robot Ventures 领投,Nvidia、Union Square Ventures、Menlo Ventures、Samsung 及 1789 Capital 参投,累计融资 1.58 亿美元。
Pyromind 押注 RSI 产业化的早期形态出现在企业 Agent 上线后的持续学习,用 AutoRL 和 Reward Data Flywheel 把真实任务反馈转化为可训练、可评估的模型能力。
Addy Osmani 认为「爱写代码 vs 爱交付」的划分过于简单,工程师面对 AI Coding Agent 的喜悦可分三种来源:创造的喜悦(心流,最安全)、知晓的喜悦(心智模型,最危险,可能让构想能力退化)、重要的喜悦(判断力权重不降反升)。他拒绝把对 AI Agent 的失落感病理化,认为悲伤是对工作有真实依恋的证明,建议主动守护构成职业认同的核心。
Lovable 在正式开始构建前会先勾勒出应用的大致外观。有用户用它搭了一个梗图生成器,可根据提示词自动挑选图片并撰写文案。
作者用一段提示词让 Grok Bot 每天早上 9 点整理前一天 AI 资讯,并试做出约 90 秒的中文讲解视频,采集、写代码和渲染全部跑在它的云端虚拟机上。
10 月 8 日发布的《State of AI Report 2026》指出,OpenAI 与 Anthropic 今年 5 月组建企业部署服务公司,前线工程师进入客户现场把模型接入业务系统并持续维护。
LangGraph 现已支持将 Qdrant 作为长期记忆的存储层,通过新的 memory store 集成,让 AI 智能体的记忆可跨对话保存与召回。Qdrant 为 LangGraph 的记忆系统带来向量原生存储与语义搜索,智能体可按语义而非精确匹配检索相关记忆,用于存储用户偏好、历史交互等上下文。
LangGraph 文档已在 docs.langchain.com 更新,涵盖 Python 版用法。同时 LangGraph 的 Qdrant 集成包已发布到 PyPI,可通过 pip 安装使用。
架构师之路在《一起玩AI》系列首讲《30分钟写好skill》中给出三个答案:需要写 skill、需要学写 skill、但不一定手搓 skill。他指出 skill 本质是文件夹而非提示词,description 是触发器,公式为具体能力清单+触发场景+用户关键词,正文按一句话定位、分步流程、边界与禁忌、Gotchas、快速参考表五段组织,其中 Gotchas 需用真实材料跑出来。
淘宝直播提出 Harness-Aware Training(HAT),把动态执行环境 Harness 状态显式纳入训练分布,通过 HSA-SFT、General OPD、HSA-RL 三阶段训练,让模型读懂当前 Harness 而非背下某一版配置。
AICon 全球人工智能开发与应用大会北京站启动议题征集,会期为 2026 年 12 月 18 日至 19 日,地点在北京新云南皇冠假日酒店。
中软融鑫总工程师于浩军在 AICon 2026 深圳站分享金融监管报送场景的 Harness 实践,通过知识底座、数据底座、受控状态机与全链路可追溯机制,把自由发挥的 Agent 改造成“宁可不答、不能答错”的受控系统。
Aether AI 发布因果智能体系统 CRIS-0 的官方 Demo,机器人在关闭微波炉门时因人手突然插入实现 0.2 秒紧急悬停。该系统由 UCSD 助理教授、CMU 因果学派学者黄碧薇创立的 Aether AI 打造,核心是因果原生的 Agent 架构,通过统一状态与因果变量、统一工具接口和因果世界模型 CausalWM 推演动作后果。
联想天禧 AI 自研的专业代码智能体框架 TianxiCode 配合 DeepSeek-v4.1-Flash,在 SWE-bench-Live(Lite 分榜)中以 71% 的问题解决率登顶全球第一,并通过官方 Verified 核验。TianxiCode 具备跨文件多跳检索、自驱动规划与多轮工具调用、闭环补丁生成与测试驱动自愈三大能力,未来将落地联想 AI 硬件产品。
TRAE 将 TraeCode 和 TraeWork 双端融合升级为新 TRAE,提供 Agent 模式和 IDE 模式两种工作方式,切换入口在右上角。Agent 模式作为全局工作台,可在同一窗口管理项目并把写代码、出文档、准备交付材料分给多个 Agent 并行推进;IDE 模式保留 SOLO 和 IDE 玩法,用于逐行细改代码。
Business Insider 资深记者 Katie Notopoulos 撰文称,她对 AI 智能体的期待不是充当行政助理,而是像妻子一样打理生活。文章为个人观点的评论,未涉及具体模型或产品。
新智元报道称,马斯克宣布 Grok Bot 将按任务接入 Claude Opus 5.5,一天后谷歌在 Google Cloud 发布会上把 Claude Opus 5 与 Sonnet 5.5 集成进 Gemini Business 企业智能体,Claude 模型首次与 Gemini 自家模型同时出现在选择器中。
Meshy.ai 创始人、CEO 胡渊鸣在公司 ARR 突破1亿美元后,写下48条创业反思,分"温度与原则""时间与 Founder Mode""AI 与人""团队与管理""战略与执行"五个板块。他提出管理者不能"惩罚责任心",创始人不应向下属索取情绪价值;并称公司几乎无限 Token,但面试仍要求手写代码。
微软将允许 Microsoft 365 Family 和 Premium 订阅者把 Copilot 及 AI 使用权益共享给同一套餐下最多五人,并可为未成年家庭成员管理 AI 访问权限。
Snyk 将其内部支持 Agent 转为客户功能 Snyk Assist,一个基于 LangChain 和 LangGraph 构建、在 LangSmith 中管理可观测性的对话式 Agent,可查询未解决问题、检查软件包漏洞、创建支持工单或记录功能请求。
TRAE 将 TraeWork 与 TraeCode 合并,保留已有开发能力,并加入 Agent 工作台,用统一界面跨项目分配任务、调度多个 Agent 并行工作。
ACC 2026 × WorkBuddy 超级个体极限挑战赛开启招募,寻找 20 位挑战者,带着一件自己真正想办成的事到 ACC 现场,用 WorkBuddy 的专家团、Skills、连接器、自动化、资料库等能力在两天内交付可当场检查的成果。
Grok Bot 现在可以直接搜索、阅读和监控 X,用户最多可创建 3 个 Bot,把品牌的社区运营、内容策略和用户分析自动化。发帖者称这对运营品牌账号的人几乎是一个"作弊码"。
Ish Verduzco 提出在 X 上管理品牌账号的三个机器人玩法:24/7 社区经理每日扫描品牌提及、汇总可扩散推文与产品反馈、推送每日摘要和紧急预警;内容策略师分析品牌历史推文的互动、回复与书签数据,推荐内容方向并构建语气/风格技能;分析师则梳理过去 30/60/90 天的互动与回复,找出有影响力账号并同步给团队。
Jerry Liu 提出「eval driven development」:如今只要定义一个 eval 并围绕它爬山,就能解决几乎任何任务,而不必直接定义确定性的或智能体的工作流。他认为数据提供方的工作就是为所有经济活动定义 eval,让前沿模型什么都能做,人的职责则变成指明方向——定义要解决什么、如何衡量做好。最复杂流程仍需显式的工作流构建界面,但多数任务可压缩为目标加 eval 指令。
Harrison Chase 认为,eval 驱动开发只适用于范围狭窄的任务,对更自主的 AI 智能体并不奏效,因为一旦度量变成目标就不再是好度量(Goodhart 定律)。Hunter Gerlach 提出的路径是:不断创建新的高价值 eval,同时对抗 Goodhart 定律,再回到第一步循环。
一个纯 Rust 项目从零重写了 Photoshop 的图层、蒙版、调整图层和矢量功能,可直接打开、编辑并保存真实的 PSD 文件。项目支持通过 CLI 或 MCP 交给脚本和 AI agent 驱动,代码托管在 github.com/openhausfun/ph。
有用户吐槽 ChatGPT 在复杂需求上表现很差:原地打转、主观能动性不足,需不断催促才继续干活,产出多为半成品,还常推翻自己最早方案导致补丁代码堆积。该用户称其表达不像人话、需反复解释,加上 computer use 后 token 消耗飞快,正考虑取消订阅。
Google Cloud发布署名Thomas Kurian的长文,推出通用办公Agent Gemini Agent,支持跨应用调用工具、定时与事件触发任务、多子Agent协作,并能依据任务在效果、速度与成本间动态选择Gemini系列或Anthropic Claude系列模型,未来计划支持更多闭源和开源模型。
对比Meta与OpenAI的办公Agent路线,能帮读者看清谷歌这次把Agent嵌入企业组织体系的具体做法。
MirroS 团队发布 AgentGarten,将可执行代码环境与实时神经渲染器连接,物理规则由代码裁决、光影由模型生成,以超过 30 fps 的吞吐让智能体持续与虚拟世界交互。