跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

31条精选相关主题模型发布行业动态AI 编码

最新精选

第 1–20 条 · 共 31 条
今天10月10日周六
  1. 小互(@imxiaohu)AI 评估 · 76/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 为 Claude Code 新增动态工作流,单次最多并行调度 1000 个智能体

    Anthropic 为 Claude Code 新增动态工作流,目前已开放公开测试,单次最多可并行调度 1000 个智能体。该功能让 Claude 为一个任务写出调度程序,由程序安排多个 Agent 分阶段完成工作:主 Agent 负责理解目标、写程序和交付答案,程序负责派任务、传递中间结果与安排后续阶段,读材料、分析和核对仍由参与执行的 Agent 完成。

    为什么值得看

    材料给出动态工作流的调度方式与并行上限,读者可据此判断多智能体任务的编排入口和成本约束。

  2. 宝玉(@dotey)AI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 的 Claude Managed Agents 开放动态工作流公测

    Anthropic 的 Claude Managed Agents 开放动态工作流公测,主智能体先写计划,再把任务分阶段派给大批智能体并行执行,最后汇总结果,单次运行最多可调度 1000 个智能体。

    为什么值得看

    内容给出上限、测试对比和计费注意事项,便于判断这类编排方式适合哪些任务。

  3. 国际大厂AI 评估 · 76/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    TypeSafe 的 Jev 十类真实用例:从 Agent 路由到自动驾驶的低成本决策

    TypeSafe AI 于 2026 年 9 月 15 日推出 Jev,并宣布获得 DCVC 领投的 4,000 万美元种子轮融资。Jev 不聊天不写文本,接收 state 与 typed questions,返回带校准概率的 Choice、Score 和 Noul 答案,通常耗时 70 到 500 毫秒,输入每百万 tokens 收费 0.042 美元、输出免费。

    为什么值得看

    梳理 Jev 的十类真实用例与每类成本延迟数据,可对照现有 LLM 工作流判断哪些小决策值得下放。

  4. 国际大厂AI 评估 · 77/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软在 Windows 发布会推出混合智能,GitHub Copilot 可调用本地模型

    微软在 10 月 8 日的 Windows 发布会上宣布将混合智能引入 Windows,通过模型路由、Windows ML 和本地 AI 能力,让 Copilot 等产品按任务复杂度、成本和隐私要求在云端与本地模型之间自动切换,GitHub Copilot 的 HydraFusion 首次可直接调用运行在 Windows PC 上的本地模型。

    为什么值得看

    微软把混合智能与模型路由引入 Windows,并让 GitHub Copilot 直接调用本地模型,读者可了解 AI PC 向 Agent 运行环境演进的具体路径。

10月9日周五
  1. 量子位AI 评估 · 80/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    谷歌发布办公Agent,可动态调用Claude系列模型

    Google Cloud发布署名Thomas Kurian的长文,推出通用办公Agent Gemini Agent,支持跨应用调用工具、定时与事件触发任务、多子Agent协作,并能依据任务在效果、速度与成本间动态选择Gemini系列或Anthropic Claude系列模型,未来计划支持更多闭源和开源模型。

    为什么值得看

    对比Meta与OpenAI的办公Agent路线,能帮读者看清谷歌这次把Agent嵌入企业组织体系的具体做法。

  2. 爱范儿AI 评估 · 79/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软发布 Surface Laptop Ultra 与 Windows 混合智能更新

    微软在特别发布会上推出 Surface Laptop Ultra,搭载 NVIDIA RTX Spark Superchip,最高 128GB 统一内存,可在本地运行超 1200 亿参数模型,起售价 2599 美元,10 月 7 日开放预订、10 月 16 日供货。

    为什么值得看

    梳理微软从硬件到 MXC 容器、混合智能调度的整条设备链路,可对照两年前 Copilot+ PC 的定位变化。

  3. Satya Nadella(@satyanadella)AI 评估 · 82/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软为 Windows 引入本地智能体与 MAI-Code-1.1 Flash 编码模型

    微软宣布为 Windows 带来不计量使用的智能能力,让每台 PC 成为智能体可安全代劳的场所。亮点包括 137B 参数、256K 上下文窗口的编码模型 MAI-Code-1.1 Flash。

    为什么值得看

    微软把编码模型放到 PC 本地运行,并让 Copilot 在设备上接管工作,读者可据此判断端侧智能体的落地方式。

  4. 技术前沿AI 评估 · 77/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 在 Gemini 中引入智能体能力,先从企业客户开始

    Google 在 Cloud 活动上宣布将 Gemini 带入智能体阶段,推出统一智能体,既能回答问题也能代用户完成任务,初期面向企业、之后再向消费者开放。该智能体可接收目标而非指令,自行规划工作并调用自定义技能与工具;默认自动选择模型,用户也可手动切换,首批第三方模型为 Anthropic 的 Claude。

    为什么值得看

    Google 把 Gemini 智能体先落到企业场景,文中给出的模型选择、系统连接与审计线索可供评估落地边界。

  5. Sundar Pichai(@sundarpichai)AI 评估 · 79/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 发布面向工作场景的统一 Gemini agent

    Google 在 NASA Hangar One 的 Gemini at Work 活动上发布新的 Gemini agent,面向工作场景提供单一通用智能体入口。

    为什么值得看

    Google Cloud 客户活动上发布统一 Gemini agent,其架构原则与跨模型编排思路可供企业评估落地路径。

10月8日周四
  1. Google Cloud BlogAI 评估 · 88/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google Cloud 发布 Gemini agent:面向工作的统一智能体

    Google Cloud 在 Gemini at Work 2026 上发布 Gemini agent,一个面向工作的统一智能体,可回答问题、处理知识工作、生成图像媒体并编写运行代码,全部通过单一提示框和单一 API 完成。

    为什么值得看

    Google Cloud 把 Gemini 从模型入口升级为统一工作智能体,读者可据此判断企业级 Agent 平台的竞争格局与落地条件。

  2. AI前线AI 评估 · 88/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI将GPT-6引入ChatGPT日常对话,并推出Intelligent UI

    OpenAI于10月7日宣布GPT-6进入ChatGPT日常对话,并推出Intelligent UI智能交互界面,向全球超过12亿周活跃用户开放。Plus、Pro、Business、Enterprise自10月7日起陆续获得GPT-6 Sol,Free和Go用户从10月8日起陆续获得GPT-6 Luna,企业工作区可用性还取决于管理员权限设置。

    为什么值得看

    梳理了GPT-6在ChatGPT全员开放的分批安排,以及Intelligent UI如何把回答变成可交互界面。

  3. 赛博禅心AI 评估 · 87/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 上线 Intelligent UI,让每个回答都能交互

    OpenAI 在 ChatGPT 中上线 Intelligent UI 能力,让回答以可交互方式展示,同时把 GPT-6 推给 ChatGPT 所有用户;付费订阅用户今天已可用,免费和 Go 用户明天上线。官方示例包括烤羊腿人数计数器、意大利婚礼七天穿搭卡片与行李清单,以及中心极限定理、三门问题等可拖动滑块或直接演示的教学内容,还能拍摄小票生成分账器这类小工具。

    为什么值得看

    原文用八个可交互示例说明 ChatGPT 回答从纯文本变为可操作界面,读者可据此判断日常用法会怎么变。

  4. AI寒武纪AI 评估 · 86/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 在 ChatGPT 推出实时智能 UI 能力

    OpenAI 在 ChatGPT 上线全新 Intelligent UI 能力,GPT-6 能根据问题当场拼装带按钮、表单、图表和交互控件的独立界面,首批覆盖 Plus、Pro、Team、Business 和 Enterprise 付费版本。

    为什么值得看

    梳理了ChatGPT实时生成可交互界面的能力与分层模型分工,可供读者判断日常对话场景的形态变化。

  5. Greg Brockman(@gdb)AI 评估 · 80/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 在 ChatGPT 推出 Intelligent UI,结合 GPT-6 提供交互式回答

    OpenAI 在 ChatGPT 中推出新能力 Intelligent UI,结合 GPT-6 现已向所有用户逐步上线。该能力用完全交互式的用户界面快速作答,让日常问题更直观、复杂话题更易理解,并可即时调用交互式工具。

    为什么值得看

    OpenAI 在 ChatGPT 中上线 Intelligent UI,读者可了解它与 GPT-6 结合后的交互形态变化。

9月30日周三
  1. 有新NewinAI 评估 · 91/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 2026 开发者大会:个人 Agent Dots、GPT-6.1 Sol 等 20 多项更新登场

    OpenAI 在旧金山举行 DevDay 2026,一次性更新 20 多项产品和能力,核心是长期在线、拥有独立云端电脑的个人 Agent Dots,由 GPT-6 Astra 驱动,可连接超过 4000 款应用并进入 Slack、Teams 等工作流。

    为什么值得看

    这场发布会把长期在线 Agent、共享工作区与云端 Codex 串成一套工作流,可据此判断开发与协作方式的变化。

  2. AI寒武纪AI 评估 · 81/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI DevDay 2026发布dots智能体、GPT-6.1 Sol与500美元Pro订阅

    OpenAI在DevDay 2026上发布20多项更新,推出可全天候自主接管工作的智能体dots,由旗舰模型GPT-6 Astra驱动,每个dot拥有独立云端计算机并连接用户授权应用,目前仅面向Pro、Business Premium和Enterprise用户开放。

    为什么值得看

    梳理了DevDay 2026二十多项更新,从主动智能体到订阅与市场,呈现OpenAI从模型到办公生态的完整布局。

  3. 赛博禅心AI 评估 · 92/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 年度 DevDay 实录:25 项发布逐一详解

    OpenAI 在旧金山举办第四届 DevDay,发布 Dots 与 ChatGPT Space 两款新产品:Dots 是一直在线的个人 agent,今天起向 Pro、Business Premium 开放,Specialist dots 面向企业预览并可接入微软 Agent 365。

    为什么值得看

    按主题逐条梳理了OpenAI DevDay的25项发布,读者可据此判断其产品矩阵与开发者平台的整体走向。

9月29日周二
  1. DatawhaleAI 评估 · 82/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek Harness 桌面版发布,同步更新 v0.2 预览版

    DeepSeek Harness 桌面版正式发布,macOS 和 Windows 安装包同步上线,并伴随 DeepSeek Harness v0.2 预览版更新。

    为什么值得看

    材料完整列出桌面版、v0.2 预览版的插件管理与创造模式等变化,可据此判断其工作流整合程度。

  2. AI前线AI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus 2.0 发布并推出个人智能体应用 Cue

    Manus 团队 9 月 28 日将产品更新到 2.0 版本,重做智能体执行框架并推出 Cascade、可长期运行的云电脑与事件触发的 Automations,同时把桌面应用升级为覆盖文档、视频和游戏制作的 Manus Studio。

    为什么值得看

    梳理 Manus 2.0 与 Cue 的功能拆解与授权边界问题,可对照 Meta Muse 观察个人智能体的两条产品路线。

9月24日周四
  1. Greg Brockman(@gdb)AI 评估 · 76/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 升级 ChatGPT Voice:可调用插件并在 ChatGPT Work 中启用

    OpenAI 宣布 ChatGPT Voice 迎来升级,现可调用邮件、日历和 Slack 等插件,并由 GPT-6 Astra、Sol 和 Luna 提供支持。该功能还可在网页端和移动端的 ChatGPT Work 中使用,通过语音创建文档、演示文稿、网站和表格,或处理浏览器内的复杂任务。即日起随最新版应用在全球范围推送。

    为什么值得看

    ChatGPT Voice 接入插件与 GPT-6 Astra 等模型,并进入 Work,读者可了解语音入口能接哪些工具。