阿里千问AI平台面向Agent全面升级,发布Agent Studio与API优速模式
在2026云栖大会MaaS&Agent技术主论坛上,阿里巴巴集团战略副总裁文征宣布千问AI平台全面升级,在模型服务基础上新增Agent服务与行业AI解决方案,并推出API优速模式、Agent Studio、千问AI座舱解决方案等能力。
在2026云栖大会MaaS&Agent技术主论坛上,阿里巴巴集团战略副总裁文征宣布千问AI平台全面升级,在模型服务基础上新增Agent服务与行业AI解决方案,并推出API优速模式、Agent Studio、千问AI座舱解决方案等能力。
Guillermo Rauch 提出软件将不再"消亡",用户若喜欢 Google Reader 这类已停运产品,可以直接生成并部署属于自己的版本,且永久归自己所有。该观点由其在社交平台发布,原文未提及具体模型、工具或技术实现方式。
在华为全联接大会 2026 期间,华为以灵衢互联协议为核心发布集群与超节点协同的新计算架构,将 CPU、NPU、内存、存储等十余种协议归一,互联带宽从百 GB 级提升至 TB 级,RTT 时延从 7 微秒降至 2 微秒,并宣称配合通算融合与多维并行优化可将十万卡集群 MFU 从 20% 提升到 35%。
网易集团副总裁、网易智企 CEO 阮良在访谈中披露,网易内部统计个人用 AI coding 效率提升 300% 甚至 500%,但整个软件交付流程只从 20 天缩短到 17 天。
Seedance 2.5 Draft Mode 已在 Pika 和 Pika API Club 上线,可按每秒 10 美分的价格快速生成草稿视频片段。满意后再将其完成为高质量成片。
Modal 分享了为 Moonshot AI 的 Kimi K2.6 模型优化推理服务以支撑编码智能体的实践,单副本每用户性能提升 2.8 倍、跨用户提升 5.6 倍。
Vercel Sandbox 的 Drives 持久化存储现已开放公测,Hobby、Pro、Enterprise 用户均可使用。Drive 可跨沙箱实例挂载复用,用于保存智能体工作区或复用数据集、模型和依赖树;每个沙箱最多挂载 4 个 Drive,默认上限 1 TiB(Hobby 为 1 GiB),可配置至 16 TiB。
Bolt 官方点名四个被用户跳过的功能:增强提示词(Enhance prompt)、plan mode、在功能之间清空上下文、以及小改动时切换到更轻量的模型。这些功能并不花哨,但效果会持续叠加。
LangSmith 更新了追踪视图,用于更清晰地展示 Jev 类决策模型的调用,呈现状态、问题、选项与输出等信息。这些 Jev 类调用出现在由大量 LLM 调用组成的 LangSmith 智能体复杂系统中。
Cognition 宣布 Devin Desktop 和 Devin CLI 现已开放使用,用户可通过 devin.ai/download 下载体验。
Lovable 披露其模型选型流程:每周测试新模型并调优,再决定路由方式,以保证构建效果最佳。文中提到 Lovable 现已支持 Fable 5.1,并附上官方博客对其模型理念的完整说明。
Opus 5.5 在 Cognition 的 FrontierCode 1.1 基准上取得 Extended 65.3% 的成绩,超越 Fable 5 登顶,且成本仅为后者的一小部分。该基准针对真实工程任务,评估代码的可合并性与质量。
Cognition 宣布 Devin 可在 Devin Desktop 和 Devin CLI 中使用,并给出下载地址 devin.ai/download。原文未披露具体功能、参数或价格信息。
AI SDK 新增对 Anthropic Claude 的支持,相关提供方文档已在 ai-sdk.dev 上线。该条信息由 AI SDK 账号发布,并同时提及 Anthropic、Claude 与 Vercel。
NVIDIA 机密计算(CC)通过内存加密的机密虚拟机(CVM)和机密 GPU,让 LLM 推理在可信环境中处理敏感数据与专有模型上下文。该方案面向个人、企业和受监管场景,为生产级 AI 推理提供私有高性能路径。
AICC2026 人工智能计算大会上,播客屠龙之术梳理出三条主线:从 Chat 到 Agent 的需求侧结构性跃迁、智能从概率拟合转向可信生产、以及算力与芯片在系统、器件、生态上的突围。会上 IDC 与浪潮信息联合发布《中国人工智能计算力发展评估报告》,并提到浪潮信息的智算系统双唯进化主张与新产品、芯算一体、让计算走进存储,以及 FlagOS 生态下的国产模型与国产芯片 Day 0 适配。
NVIDIA 推出 Topograph,用于拓扑感知的 GPU 工作负载调度。AI 工厂受功耗限制,工作负载放置不当会割裂拓扑域、把流量挤到共享链路,导致吞吐下降、作业成本上升,GPU 还会空耗电力等待数据。Topograph 通过优化放置来提升利用率。
Visual Studio 演示了用内存转储事后调试 C# 生产崩溃的流程:监控 ThreadPool,任务超过 3 秒阈值即调用 Windows API 生成 .dmp 文件,再用 Debug with Mixed 打开。
LiteParse v2.14.6 让文本型 PDF 解析速度提升约 25%,实测处理速度达 2.8ms/页,比次快的本地解析器快 1.5 倍。该开源工具可在本地以 Python、Node.js、Rust 运行,也可直接在浏览器中使用。
Lovable 阐述了其模型哲学:每周都有新 AI 模型发布,团队会逐一测试、调优并决定其路由方式,以保证用户的构建获得最佳结果。Lovable 目前已支持使用 Fable 5.1 进行构建。
mem0 发布 DolphinBench,这是一个面向 AI 智能体记忆的评测基准,把准确率、成本与延迟放在同一张榜单上。它不再像传统记忆评测那样只出题判分,而是考察长历史之后智能体能否在工具调用中采取正确行动。DolphinBench 已在 dolphinbench.ai 上线。
Transformers 与 ggml 合作,通过在 `kernels` 库中调用 GGML kernels,让 GGUF 模型加载从反量化改为直接运行,性能追平 llama.cpp。此前 Transformers 已支持加载 GGUF 文件多年,这次改动由 @_marcsun 完成。
Docker 在 9 月 23–25 日圣何塞 WeAreDevelopers World Congress North America 的 Docker Pavilion 带来合作伙伴与客户分享,覆盖模型提供商、MCP 工具与网关、身份安全、可观测性和代码质量。
快手技术团队联合北京航空航天大学提出面向工业级推荐模型训练的自适应检查点系统 AdaptCP,相关论文已被 EuroSys 2027 接收。
NVIDIA DLSS 5 引入 DLSS 3D-Guided Neural Rendering 与更细粒度的控制项,让游戏开发者在保持艺术意图的同时加入更逼真的光照与材质细节。此次同步更新 NVIDIA ACE、RTX Mega Geometry 2.0 与 RTX Kit,覆盖角色 AI、高密度几何与渲染工作流。
前 OpenAI 核心研究员、TypeSafe AI 创始人 Diogo Almeida 在播客 Latent Space 完整访谈中,解释其新模型 Jev 为何完全不做文本生成,只向程序输出带概率和置信度的决策,并以代码作为唯一消费者。
阶跃星辰 Step 5 Preview 已在豆包旗下 AI 开发产品 TRAE 上线,可直接在 TRAE 中调用,覆盖 9 类任务、33 种编程语言,从复杂代码库理解、跨文件修改到 Bug 修复、重构、性能调优及数小时长程任务。官方公布 DeepSWE 67.7 分、ProgramBench 通过率 80.5%。
NVIDIA 介绍如何借助 AI Agent 与 Isaac ROS 加速 ROS 2 节点:即使 CUDA kernel 很快,消息在节点间仍可能经 CPU 内存序列化或拷贝,抵消 GPU 上感知与 AI 负载的收益。此次通过上游抽象与 NVIDIA 近期推出的 CUDA buffer 后端来消除这一瓶颈。
火山引擎存储分享 ADrive 跨产品协作实践,基于 ve-adrive-cli v1.0.2,展示如何选择一个正在进行的内容项目、跑通第一个文件协作闭环。ADrive CLI 已在 GitHub 发布并提供下载,开通 ADrive 需联系 ADrive 团队申请试用。
火山引擎推出 ADrive 智能网盘,让 Agent 直接读取项目资料并把成果保存回同一项目空间,团队成员再从熟悉的文件夹接手审阅。项目空间可挂载为本地盘符,人和 Agent 共用同一文件夹;未授权的写入尝试在演示中三次均被拒绝,操作留有审计记录。该产品已开放企业版试用申请。
腾讯T12资深搜索后台工程师吴银光在2025年初卸下管理头衔,转入大模型推理工程团队,从性能评测、服务部署等周边工作起步并深入阅读 SGLang 源码。他梳理出推理工程入门路径:建立 Transformer 结构认知、掌握 TTFT/TPOT/QPS 等评估指标、了解 MoE 与 MLA 等结构演进,再选 PD 分离、分布式 KV Cache、推测解码等方向深挖。
腾讯云城市峰会圆桌讨论聚焦 AI 数字员工落地:企业用 AI 分“能对话、能干活、能上岗”三级,其中“能上岗”最难。科拓把停车场收费、抬杆等管理权交给 AI 岗亭,蝉妈妈将客服 AI 接管研发问题响应后,研发被打断比例降低 70% 以上、响应时间缩短 80% 以上;华祥苑的“店效 AI 经营官”已开 10 万次门店会议,覆盖近 1000 家门店。
AMD 软件副总裁 Anush Elangovan 在播客中介绍 ROCm——AMD 面向自家硬件加速器的统一开源软件层与工具链,并称智能体 AI 正在大幅降低底层硬件编程的门槛,软硬件开发周期的收敛也在加快。
Ollama 上 deepseek-v4.1-flash 模型的部分请求因费率错误被多扣用量,官方已致歉并重置用户月度(或旧方案的周度+会话)用量,同时把该模型造成的额外消耗额度返还到账户。
阿里在云栖大会集中发布 ROLL、RTP-LLM、Atrex Kernel Agent、OpenSandbox、Open Agent Auth、OpenCodeReview 六个开源项目,分别面向大规模强化学习、生产级推理、异构算子生成优化、Agent 沙箱运行、企业级授权和智能代码评审。
Qwen-Image-2.1 在发布当天获得 Intel OpenVINO 的 Day-0 支持,可在 Intel 硬件上优化运行。该模型以单一开放权重 checkpoint 同时支持图像生成与编辑。
腾讯混元团队把 Hy4 preview 的权重从约 1.5TB 压缩到 214 GiB,参数量仍为 770B,改变的是权重的表示方式。
百度2026最高奖由“天池”和“dodo”两支团队获得,李彦宏在9月21日秋日嘉年华现场各颁发一张百万美元支票。天池实现32卡到512卡GPU的Scale-Up全域高速互联,GPU卡间互联带宽提升8倍、通信时延降低40%、单Token推理成本优化40%以上,为全球首个基于X86平台的超节点产品。
腾讯云开发者团队在约两个月内替换大型项目登录系统时,用 Makefile、Docker、Helm、CSGHub 和 Kubernetes 搭建了轻量化平台“小 TKE”,让每位开发者在 DevCloud 独立 Namespace 中自助部署验证。
Anthropic 的 Claude Opus 5.5 已在 Vercel AI Gateway 上线,模型标识为 anthropic/claude-opus-5.5,支持 1M token 上下文窗口和最多 128K 输出 token,面向智能体编码、长时智能体任务和专业知识工作。
Claude Opus 5.5 上线 Vercel AI Gateway,同时列出两项会导致 400 报错的 API 不兼容变更,便于现有调用方迁移。