跳到正文
10月10日 · 周六

当前筛选 · 今日精选 2 条

最近精选动态:10月10日 03:23

查看最新动态 →

最新精选

今天10月10日周六
  1. 宝玉(@dotey)AI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 的 Claude Managed Agents 开放动态工作流公测

    Anthropic 的 Claude Managed Agents 开放动态工作流公测,主智能体先写计划,再把任务分阶段派给大批智能体并行执行,最后汇总结果,单次运行最多可调度 1000 个智能体。

    为什么值得看

    内容给出上限、测试对比和计费注意事项,便于判断这类编排方式适合哪些任务。

  2. 国际大厂AI 评估 · 76/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    TypeSafe 的 Jev 十类真实用例:从 Agent 路由到自动驾驶的低成本决策

    TypeSafe AI 于 2026 年 9 月 15 日推出 Jev,并宣布获得 DCVC 领投的 4,000 万美元种子轮融资。Jev 不聊天不写文本,接收 state 与 typed questions,返回带校准概率的 Choice、Score 和 Noul 答案,通常耗时 70 到 500 毫秒,输入每百万 tokens 收费 0.042 美元、输出免费。

    为什么值得看

    梳理 Jev 的十类真实用例与每类成本延迟数据,可对照现有 LLM 工作流判断哪些小决策值得下放。

10月9日周五
  1. Satya Nadella(@satyanadella)AI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软为 Windows 引入本地智能体与 MAI-Code-1.1 Flash 编码模型

    微软宣布为 Windows 带来不限量的本地智能能力,让每台 PC 成为智能体可安全代劳的工作环境。其中 MAI-Code-1.1 Flash 是 137B 参数、256K 上下文窗口的编码模型,已针对 PC 本地运行优化;GitHub Copilot 可把工作交给此类本地模型,降低项目成本。

    为什么值得看

    微软把本地编码模型、Copilot 与 Windows 安全沙箱组合起来,读者可据此判断端侧智能体的落地路径。

10月8日周四
  1. Google Cloud BlogAI 评估 · 88/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google Cloud 发布 Gemini agent:面向工作的统一智能体

    Google Cloud 在 Gemini at Work 2026 上发布 Gemini agent,一个面向工作的统一智能体,可回答问题、处理知识工作、生成图像媒体并编写运行代码,全部通过单一提示框和单一 API 完成。

    为什么值得看

    Google Cloud 把 Gemini 从模型入口升级为统一工作智能体,读者可据此判断企业级 Agent 平台的竞争格局与落地条件。

  2. 国际大厂AI 评估 · 77/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软在 Windows 发布会推出混合智能,GitHub Copilot 可调用本地模型

    微软在 10 月 8 日的 Windows 发布会上宣布将混合智能引入 Windows,通过模型路由、Windows ML 和本地 AI 能力,让 Copilot 等产品按任务复杂度、成本和隐私要求在云端与本地模型之间自动切换,GitHub Copilot 的 HydraFusion 首次可直接调用运行在 Windows PC 上的本地模型。

    为什么值得看

    微软把混合智能与模型路由引入 Windows,并让 GitHub Copilot 直接调用本地模型,读者可了解 AI PC 向 Agent 运行环境演进的具体路径。

  3. 赛博禅心AI 评估 · 87/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 上线 Intelligent UI,让每个回答都能交互

    OpenAI 在 ChatGPT 中上线 Intelligent UI 能力,让回答以可交互方式展示,同时把 GPT-6 推给 ChatGPT 所有用户;付费订阅用户今天已可用,免费和 Go 用户明天上线。官方示例包括烤羊腿人数计数器、意大利婚礼七天穿搭卡片与行李清单,以及中心极限定理、三门问题等可拖动滑块或直接演示的教学内容,还能拍摄小票生成分账器这类小工具。

    为什么值得看

    原文用八个可交互示例说明 ChatGPT 回答从纯文本变为可操作界面,读者可据此判断日常用法会怎么变。

  4. 爱范儿AI 评估 · 79/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软发布 Surface Laptop Ultra 与 Windows 混合智能更新

    微软在特别发布会上推出 Surface Laptop Ultra,搭载 NVIDIA RTX Spark Superchip,最高 128GB 统一内存,可在本地运行超 1200 亿参数模型,起售价 2599 美元,10 月 7 日开放预订、10 月 16 日供货。

    为什么值得看

    梳理微软从硬件到 MXC 容器、混合智能调度的整条设备链路,可对照两年前 Copilot+ PC 的定位变化。

9月30日周三
  1. 有新NewinAI 评估 · 91/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 2026 开发者大会:个人 Agent Dots、GPT-6.1 Sol 等 20 多项更新登场

    OpenAI 在旧金山举行 DevDay 2026,一次性更新 20 多项产品和能力,核心是长期在线、拥有独立云端电脑的个人 Agent Dots,由 GPT-6 Astra 驱动,可连接超过 4000 款应用并进入 Slack、Teams 等工作流。

    为什么值得看

    这场发布会把长期在线 Agent、共享工作区与云端 Codex 串成一套工作流,可据此判断开发与协作方式的变化。

  2. AI寒武纪AI 评估 · 81/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI DevDay 2026发布dots智能体、GPT-6.1 Sol与500美元Pro订阅

    OpenAI在DevDay 2026上发布20多项更新,推出可全天候自主接管工作的智能体dots,由旗舰模型GPT-6 Astra驱动,每个dot拥有独立云端计算机并连接用户授权应用,目前仅面向Pro、Business Premium和Enterprise用户开放。

    为什么值得看

    梳理了DevDay 2026二十多项更新,从主动智能体到订阅与市场,呈现OpenAI从模型到办公生态的完整布局。

  3. 赛博禅心AI 评估 · 92/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 年度 DevDay 实录:25 项发布逐一详解

    OpenAI 在旧金山举办第四届 DevDay,发布 Dots 与 ChatGPT Space 两款新产品:Dots 是一直在线的个人 agent,今天起向 Pro、Business Premium 开放,Specialist dots 面向企业预览并可接入微软 Agent 365。

    为什么值得看

    按主题逐条梳理了OpenAI DevDay的25项发布,读者可据此判断其产品矩阵与开发者平台的整体走向。

9月29日周二
  1. DatawhaleAI 评估 · 82/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek Harness 桌面版发布,同步更新 v0.2 预览版

    DeepSeek Harness 桌面版正式发布,macOS 和 Windows 安装包同步上线,并伴随 DeepSeek Harness v0.2 预览版更新。

    为什么值得看

    材料完整列出桌面版、v0.2 预览版的插件管理与创造模式等变化,可据此判断其工作流整合程度。

  2. AI前线AI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus 2.0 发布并推出个人智能体应用 Cue

    Manus 团队 9 月 28 日将产品更新到 2.0 版本,重做智能体执行框架并推出 Cascade、可长期运行的云电脑与事件触发的 Automations,同时把桌面应用升级为覆盖文档、视频和游戏制作的 Manus Studio。

    为什么值得看

    梳理 Manus 2.0 与 Cue 的功能拆解与授权边界问题,可对照 Meta Muse 观察个人智能体的两条产品路线。

9月24日周四
  1. Greg Brockman(@gdb)AI 评估 · 76/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 升级 ChatGPT Voice:可调用插件并在 ChatGPT Work 中启用

    OpenAI 宣布 ChatGPT Voice 迎来升级,现可调用邮件、日历和 Slack 等插件,并由 GPT-6 Astra、Sol 和 Luna 提供支持。该功能还可在网页端和移动端的 ChatGPT Work 中使用,通过语音创建文档、演示文稿、网站和表格,或处理浏览器内的复杂任务。即日起随最新版应用在全球范围推送。

    为什么值得看

    ChatGPT Voice 接入插件与 GPT-6 Astra 等模型,并进入 Work,读者可了解语音入口能接哪些工具。

  2. OpenAI(@OpenAI)AI 评估 · 80/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为 ChatGPT Voice 加入插件支持与 ChatGPT Work

    OpenAI 宣布 ChatGPT Voice 现在可以使用邮箱、日历和 Slack 等插件,并由 GPT-6 Astra、Sol 和 Luna 驱动。该功能可在 Web 和移动端的 ChatGPT Work 中使用,用户通过语音创建文档、演示文稿、网站和表格,或在浏览器中处理复杂任务,即日起随最新版应用全球推送。

    为什么值得看

    ChatGPT Voice 接入邮箱、日历和 Slack 等插件,并进入 ChatGPT Work,可据此判断语音交互的适用边界。

9月2日周三
  1. Google DeepMind BlogAI 评估 · 79/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 为 Gemini 3.7 Flash 等模型推出智能体视频理解功能

    Google DeepMind 为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 推出智能体视频理解功能,通过原生视频工具动态搜索、扫描目标片段,替代固定帧率的静态处理方式。

    为什么值得看

    原文给出 token 与成本降幅及基准表现,读者可据此判断长视频分析的落地成本变化。

8月31日周一
  1. MiniMax 稀宇科技AI 评估 · 76/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MiniMax 将 H3 Max 接入开放平台与 Design,支撑 24 小时 AI 直播

    MiniMax 将 H3 Max 768P、H3 Max 480P 接入开放平台和 MiniMax Design,该模型生成 5 秒 768p 音视频不到 3 秒,15 秒视频约 15 秒完成,吞吐量约为 MiniMax H3 的 35 倍。

    为什么值得看

    H3 Max 把 5 秒 768p 音视频生成压进 3 秒内,读者可据此理解实时直播这类新场景的门槛变化与并发限制。

8月28日周五
  1. ollama(@ollama)AI 评估 · 80/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ollama 上线 GLM-5.3,并提供云端 Flash 版本

    Ollama 正在上线 GLM-5.3,提供私有、快速、美国和欧洲托管、不留存数据的服务,并推出云端版本 GLM-5.3-Flash 供试用。

    为什么值得看

    GLM-5.3 在 Ollama 上线并提供云端 Flash 版本,读者可了解在 Claude Code 等工具中的接入方式与开源权重入口。

8月27日周四
  1. LangChain BlogAI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangGraph Platform 正式 GA,面向长时间运行的有状态 Agent 提供部署与管理

    LangChain 宣布 LangGraph Platform 正式 GA,定位为部署和扩展长时间运行、有状态 Agent 的基础设施与管理层;自去年 6 月 beta 以来,已有近 400 家公司用它把 Agent 部署到生产环境。

    为什么值得看

    原文列出 1-click 部署、30 个 API 端点和持久化层等能力,并给出三种部署选项的适用边界。

8月25日周二
  1. SemiAnalysisAI 评估 · 88/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI Jalapeño 芯片实测:能效超过 Nvidia Blackwell

    OpenAI 在 Hot Chips 上公布了与 Broadcom 合作自研的推理芯片 Jalapeño,设计始于 2024 年中,约 16 个月完成流片,SemiAnalysis 受邀在其实验室用 InferenceX 实测该芯片。

    为什么值得看

    SemiAnalysis 在 OpenAI 实验室实测其首款推理芯片 Jalapeño,给出逐场景吞吐与能效对比及架构细节。

8月13日周四
  1. DeepSeek(@deepseek_ai)AI 评估 · 80/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek 发布 Harness v0.1 开发者预览版并开源

    DeepSeek 发布 DeepSeek Harness v0.1 开发者预览版,面向全球构建 agent harness 的开发者开放,并以 MIT 许可证开源代码库。该工具基于 Cordis 元框架,核心思路是“一切皆插件”,模型、工具、技能、会话、沙箱、文件系统、循环、编排和 UI 均以插件实现,可混搭、替换和扩展。代码库地址为 github.com/deepseek-ai/de…。

    为什么值得看

    官方给出插件化 agent harness 的开放入口与 MIT 许可,可据此判断现有智能体工作流的可替换程度。