NVIDIA Nemotron 与 OpenShell 让 AI 智能体排查电信网络故障
NVIDIA 展示用 AI 智能体处理电信网络故障:遇到 runbook 里没有的修复方案时,智能体可自行排查、比较修复方案并在仿真中测试。其中 NVIDIA Nemotron 负责帮智能体推理问题,NVIDIA OpenShell 则管控智能体可访问和操作的范围。
NVIDIA 展示用 AI 智能体处理电信网络故障:遇到 runbook 里没有的修复方案时,智能体可自行排查、比较修复方案并在仿真中测试。其中 NVIDIA Nemotron 负责帮智能体推理问题,NVIDIA OpenShell 则管控智能体可访问和操作的范围。
NVIDIA 提供全栈方案,把开放模型转化为理解电信网络的专业智能体,同时让运营商保持控制权。AT&T、SoftBank 和 Indosat 正采用开放模型用于自主网络运营等场景,并针对本地语言和行业需求进行适配。
Recraft 编辑器的首次渲染速度提升 15–19%,下载字节数完全不变。原因是把原本排在页面最后请求的 9 MB WebAssembly 引擎做了加载顺序修复,Sergey Patrakeev 撰文披露了改动过程并附上 A/B 对比数据。
JetBrains 的 Human-AI eXperience 团队与隆德大学研究者合作,提出一套审查 AI 生成代码的概念框架,核心观点是审查 AI 生成代码的关键问题是"信任校准",而非传统的 diff 比对。
QCon London 2027 将于 4 月 13–16 日在伦敦 QEII Centre 举行,设 15 个专题,覆盖生产级 AI、架构与规模化工程,超 75 位实践者将分享生产系统与取舍经验。专题包括面向 Agentic AI 系统的评估平台与护栏、AI 时代的架构、以及为下一代软件工程设计 SDLC 等。会议还设有 Unconference 环节,多数场次回放保留 12 个月。
Google 与 Constellation Energy 达成新合作,通过升级伊利诺伊、宾夕法尼亚和新泽西六座在运核电站,为 PJM 电网增加 890MW 清洁核电,同时部署 Google Cloud 的 Gemini Enterprise 智能体工作流优化核电站运营。
IntelliJ IDEA 基于 LSP 的 Java and Kotlin 扩展已进入 Release Candidate 阶段,稳定 1.0 版即将发布。
作者把 Claude Code 放进 Docker Sandboxes 的 microVM 沙箱中,让它在无需逐步批准命令的情况下完成给 Flask 应用添加 /health 端点、编写测试、构建镜像并通过全部三项测试。
Browser Use 发布 Extensions 功能,可上传任意 Chrome 扩展并在智能体打开首个页面前完成加载,支持广告拦截器、密码管理器和用户自建扩展,目前已在官网和 X 上线。
Baseten 工程师 Shawn Rushefsky 分享实验,让 Claude Code 为 Qwen-3.6-35B-A3B 自主编写并优化推理引擎 VibeQwen。
乔木剪藏插件新增「转写学习」,在原有 B 站、YouTube、小宇宙之外支持 TikTok 和 TED 在线转写字幕显示。按三个 A 可进入沉浸式学习状态,左侧视频、右侧字幕,并能打开 AI 对话提问,插件已在 GitHub 开源。
MiniMax 的 Morgan Suo 将在 AI Engineer New York 演讲《The Hidden Costs of a Faster Model》,拆解量化、投机解码与推理控制在生产环境中究竟改变了什么。该分享定于 10 月 14 日举行。
Mistral Large 4 已在 AI Gateway 上线,该开源权重模型原生支持多模态,将推理与文本、图像理解结合,适用于网络防御、制造和金融工作流。
Epoch AI 发布研究,梳理中国六家头部 AI 公司(阿里、字节、Z.ai、月之暗面、DeepSeek、MiniMax)的五类收入来源:面向消费者的 AI 应用、售卖模型访问、面向企业和政府的定制部署、授权费,以及用 AI 带动既有产品线。
Elastic 宣布加入 OpenAI Daybreak Defense Network,并将通过 Elastic Inference Service(EIS)把 OpenAI 的 Daybreak 前沿模型引入 Elastic Security,让安全分析师在现有工作流内完成告警研判、调查、检测工程与修复,无需自建模型基础设施。
Perplexity App for Mac 在 26.37.1 版本中新增标签页,并支持将会话在独立窗口中打开,面向所有 Mac 上的 Computer 用户开放。用户可以并行运行多个任务,或把不同会话放到不同屏幕上,用于高强度多任务处理。
智谱(Z.ai)的 GLM 5.3 现已在 Amazon Bedrock 上线,这是一个 753B 参数的 MoE 模型,面向编码与长时程智能体任务,Z.ai 报告其在 CyberGym 基准上取得 84.5 分。
OpenAI 展示 Codex CLI 的终端用法:可通过语音启动任务,跨项目统一管理智能体,并用独立的 worktree 探索另一条实现方向。该演示面向常驻终端的开发者,具体版本与可用性信息未披露。
Zip 团队将聊天机器人重建在 LangGraph + LangSmith 上,此前为智能体添加新功能需要数周手工编写 LLM 调用、存储与上下文代码,如今每条 trace 都自动就位,无需手写一行代码。
Ziphq 将其智能体从手写 LLM 调用、存储与上下文代码迁移到 LangGraph 和 LangSmith 后,新增功能从耗时数周变为无需编写任何代码即可完成完整追踪。该团队重建聊天机器人后,每次 trace 都自动记录,无需手写一行代码。
在 AWS GovCloud (US) 区域,Claude Opus 5.5、Claude Sonnet 5.5 和 Claude Sonnet 5 已通过 Amazon Bedrock 提供。
亚马逊 SageMaker AI 推出 aws-ai-ml 技能,通过 Agent Toolkit for AWS 接入 Kiro、Claude Code、Codex 等支持 MCP 的编码智能体。
Mistral AI 为 Vibe 推送更新,获取全部三项能力需执行 vibe update。Vibe 新用户可通过 `uv tool install mistral-vibe` 安装,更多信息见官方文档。
Eon 推出 Era,可生成一个跨 Salesforce、Zendesk、Slack、Jira、Gong、Deel 等系统的完整模拟企业,各系统行为还原真实厂商的速率限制、分页与错误码,智能体通过实时 MCP 和 API 接口与之交互。
Cursor SDK 新增对本地 TypeScript 智能体的 Steering 与系统提示词支持。后台子智能体的结果现在可在本地以 TypeScript 和 Python 返回。更多更新详见 cursor.com/docs/sdk/chang…。
Cursor 支持用户用自己的 system prompt 替换其系统提示词,Rules、skills 和 tool schemas 仍会正常加载。该功能正按账号逐批开放。
Dan 与父亲 Steve 在 Replit 上为 Cockle Finance 自建定制工具,3 个月内业务增长 15%,承接了以往无法消化的更多业务。该工具由 Dan 制作、构建于 Replit,帮助这家公司实现规模化。
基于 Amazon Bedrock AgentCore 的 Quick Resource Migrator 示例 MCP 服务器,可一次工具调用完成 Amazon Quick 聊天智能体、action connectors、知识库、flows 和 spaces 从开发 AWS 账户到生产账户的跨账户迁移,操作幂等且带版本化备份与只读预览。
Fireworks AI 宣布 DeepSeek V4.1 Flash 现可在 Dedicated Training API 和 Managed Training 两个入口上训练。官方称它是智能体编码、终端自动化和工具调用的强基础模型,且服务成本很低,并给出了微调文档链接 docs.fireworks.ai/fine-tuning/mo…。
Amazon Bedrock Managed Knowledge Bases 现已支持 agentic retrieval,通过 AgenticRetrieveStream API 把多部分问题拆成子查询、循环检索并判断证据是否充分,而 Retrieve API 只做一次混合搜索。
Milvus 为 HNSW 提供 HNSW_SQ、HNSW_PQ 和 HNSW_PRQ 三种向量压缩索引,用于降低图构建与距离计算中的内存占用。SQ 对每一维量化,SQ8 与 SQ6 分别用 8 位和 6 位,SQ4U 用 4 位无符号值并共享统一范围;PQ 将向量切分为子向量并以码本索引表示;PRQ 在 PQ 基础上分阶段编码残差,代价是额外训练、构建与距离计算开销。
Hugging Face 将 Claude Code、Codex、Hermes、Pi、opencode 等编码外壳转为 RL 环境,无需改动外壳和训练代码,支持任意开源模型与任务集并完全开源。
ContextQA 推出自主质量工程师 Ship,可从 Slack 或 Linear 接收 bug 报告并复现,再把上下文交给 Claude Code 或 Codex 完成修复。该工具面向已部署的 PR 进行测试,用户可免费在 ship.contextqa.com 试用。作者指出,编码智能体需要这类反馈闭环,才能更好地修复自身 bug,而验证 agent 写的代码正成为软件工厂的一大瓶颈。
有 Cloudflare 重度用户指出,用户量上去后 Serverless 几乎一定比 VPS 贵,用云平台尤其 Durable Objects 会出现天价账单概率,VPS 被刷最坏是机器打满、站点挂掉。
Cohere 推出 North 2,称这是其迄今最大的一次升级,带来 15+ 项新功能,瞄准企业级智能体 AI 在可扩展性、模型主权和企业级安全上的短板。原文未披露具体功能细节、模型版本或开放情况。
NestJS Observe 是面向 NestJS 的框架感知可观测性方案,利用框架对 controller、provider、guard、interceptor、GraphQL resolver 和微服务处理器的认知来定位请求耗时。
邮件服务商正用机器学习取代固定规则来判定发件人声誉,模型会同时分析正文措辞、链接与附件特征、发送频率突增,并结合历史发件行为和收件人实时互动做出整体判断,因此上下文比单个关键词更重要。
歸藏(guizang.ai)基于 Muse Gadgets 与 M5 Stack 的 Stop Watch Meta 做出一款硬件小玩具,接入 MiniMax API,并做了 UI 优化:更改语言、增加语音输出,还能磁吸在电脑屏幕旁。他称 Muse Gadgets SDK 内置多个常见 ESP 32 设备固件,直接刷入即可使用。
歸藏用 Muse Gadgets SDK 在 M5 Stack 的 Stop Watch Meta 上做了个小玩具,认为该 SDK 原始设计太臃肿拥挤且默认非中文,于是重新调整了整体 UI 使其更协调、界面改为中文,并把中间形象换成与自己 Muse 相同的橘猫。他提到这个 SDK 很方便,已内置数款常见 ESP32 设备固件,直接刷入即可。
Uber 工程团队分享了面向 AI Agents 的企业级 MCP 管理平台设计,用“控制平面 + 数据平面”的网关体系把全公司数千个存量 API 自动转译成 MCP 工具,目前已托管 800+ MCP 服务器和 5000+ 工具。