跳到正文

#MCP/工具调用

今日 35 条
9月19日周六
  1. idoubi(@idoubicc)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AutoJev 为 AI 智能体提供决策层,支持 MCP、REST 和 Agent Skills

    AutoJev 为 AI 智能体提供一层决策层:在智能体路由任务、选择模型、调用高风险工具或完成重要工作前,可向 AutoJev 请求结构化决策。该产品支持 MCP、REST 和 Agent Skills,可通过 autojev.ai 试用。

  2. 阿里云开发者AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    云栖大会 Skill 上线千问 AI 平台:Codex、Claude Code、Cursor 等 Agent 都能用

    云栖大会 Skill 在千问 AI 平台正式上线,基于开放的 Agent Skills 标准开发,Codex、OpenClaw、Claude Code、Cursor 等支持 Skills 的 Agent 均可使用,官方推荐千问办公和 Qoder。

  3. 袋鼠帝AI客栈AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    WorkBuddy 接入 Miora,袋鼠帝开源 3 个 AI 短片制作 Skill

    袋鼠帝把 AI 短片制作流程沉淀为 3 个 Skill 并开源:视觉资产提示词、动作打戏提示词和 Miora 视频执行规范,可直接装入 WorkBuddy 使用。

  4. Yangyi(@Yangyixxxx)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 插件支持绑定同 Provider 多个账号,新增 MCP profile tool 标注账号

    ChatGPT 插件现已支持连接同一 Provider 的多个账号,把工作与个人账号的上下文带入同一段对话,用户可在插件目录 chatgpt.com/plugins 完成绑定。开发者无需改动即可自动生效;若在 MCP server 中加入 profile tool,ChatGPT 可为各账号添加标注。

  5. Harrison Chase(@hwchase17)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 作者:browser use 是 Jev 目前最佳应用

    LangChain 作者 Harrison Chase 称 browser use 是他在 Jev 上见过的最佳应用。Nathan Drezner 用 LangChain 搭配 typesafeai 的 Jev 构建了浏览器智能体,他表示该组合在玩 Wikipedia Game 上表现出色,也擅长找便宜机票这类"叠衣服"式的琐碎任务。

  6. GitHub(@github)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GitHub Copilot SDK 直播:无需自建 agent loop 即可构建智能体应用

    GitHub 举办面向初学者的直播,讲解如何用 GitHub Copilot SDK 把 Copilot 的 agent runtime 嵌入应用,无需自己实现 agent loop。内容涵盖 sessions、tools、MCP servers、streaming events,并设有 .NET 和 Java 开发专场,无需 SDK 经验,提供英、中、葡、西、日、韩六种语言报名。

  7. Greg Brockman(@gdb)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 插件支持连接多个账号,把工作与个人上下文汇入同一对话

    ChatGPT 插件现已支持连接多个账号,用户可把工作和个人账号的上下文带进同一段对话,需在插件目录 chatgpt.com/plugins 中完成连接。开发者无需改动即可自动生效;若在 MCP server 中加入 profile tool,ChatGPT 还能为账号打上标签,让插件用户体验更好。

  8. Simon Willison(@simonw)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Code 2.1.277 起支持 AGENTS.md

    Claude Code 从 2.1.277 版本起支持 AGENTS.md:当文件夹中没有 CLAUDE.md 时,Claude 会自动查找并使用 AGENTS.md,该行为可在 /config 中切换。

  9. Vercel NewsAI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    mcp-handler 新增 WebMCP 实验性支持

    mcp-handler@2.2.0 新增对 WebMCP 的实验性支持,可将现有 MCP 工具暴露给浏览器内智能体。只需在站点加入一个 script 标签,并在 experimental_webMcp 的 tools 中声明工具,脚本会将这些工具注册到页面并把调用代理回 MCP 服务器,以已登录用户身份执行,无需浏览器端 OAuth 流程。

  10. eric zakariasson(@ericzakariasson)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok 机器人新增 webhook 触发器,可从任意来源唤醒

    Grok 的 bot 现在支持 webhook 触发,从任意位置唤醒。创建 routine 后点击「add trigger」选择 webhook,即可接入 WhatsApp 特定联系人消息、Notion 页面变更、家庭温度传感器阈值、桌面按钮、GitHub Action 完成或服务器错误率飙升等事件。

  11. Vercel NewsAI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    v0 现可从共享环境变量读取 npm 凭据,安装私有包

    Vercel 的 v0 现可读取 Vercel 上共享环境变量中存储的凭据,从 npm 及自定义 registry 安装私有包。NPM_TOKEN 用于 registry.npmjs.org 上的私有包,NPM_RC 可配置自定义或多个 registry,支持作用域 registry 与环境变量引用,例如 @acme 作用域或私有 JFrog Artifactory。

9月18日周五
  1. MiniMax 稀宇科技AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MiniMax Code CLI v0.4.12 以 MIT 协议开源

    MiniMax Code CLI 的 v0.4.12 版本面向全球开发者开放,并以 MIT 协议开源,它是 MiniMax Code 客户端的核心组件,源码已发布在 GitHub。

  2. Dify(@dify_ai)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Dify 问题分类器节点接入 TypeSafe AI 的 Jev 模型

    TypeSafe AI 的 Jev 模型现已接入 Dify 的问题分类器节点,用于在工作流分支间路由输入。该模型专为结构化决策设计,用户可直接在 Dify 中试用。

  3. Hamel HusainAI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI Evals 常见问题大全:从错误分析到评估器验证

    Hamel Husain 整理了他与 Shreya 在向 5000+ 名工程师和 PM 讲授 AI Evals 时收到的最常见问题,组成一份按主题分类的 FAQ。

  4. Vercel NewsAI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    TypeSafe AI 的 Jev 成为 Vercel AI Gateway 史上采用最快的模型

    TypeSafe AI 的 Jev 在 Vercel AI Gateway 上线 24 小时内,采用它的付费团队数量超过以往任何模型发布的两倍。Jev 在上线后首 12 小时超过所有对比模型,并在此后继续扩大领先;到第 24 小时,近 13% 的付费团队在使用它,是 GPT-5.6 系列的 2 倍、Fable 5.1 份额的 6 倍以上。

  5. idoubi(@idoubicc)AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jev 决策模型上线 OpenRouter:只做布尔判断、枚举选择与候选打分

    Jev 决策模型已在 OpenRouter 上线,定位为 System One,不做长文生成,只处理布尔判断、枚举选择、候选打分三类决策任务。它不兼容 OpenAI Chat Completions 格式,需用 Decisions API 自行拼 state 与 questions。典型场景包括搜索意图识别、本地模型网关路由和多 Agent 协作中的 Bot 分派。

  6. Browser Use(@browser_use)AI 评估 · 14/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Browser Use Cloud 将上线 ULTRAFAST:更快、更便宜、更难被检测

    Browser Use Cloud 即将上线 ULTRAFAST,官方称其具备超人类速度、成本低且难以被检测三项特性。用户可在等待名单登记,并说明自己想要自动化的任务。ULTRAFAST 目前尚未公布具体参数与上线时间。

  7. 腾讯云开发者AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    换一套 Harness 比换两代模型还管用:Agent Harness 工程化综述

    一篇综述把 Agent 的能力来源从模型转向模型之外的 Harness,按「一个循环、四个子系统、生产化、长时运行、评测、选型」展开。

  8. 硅谷101AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    外滩大会圆桌:Agent 成为交易主体前夜,信任基建怎么搭

    在2026 Inclusion·外滩大会主论坛圆桌“当Agent成为交易主体”上,蚂蚁集团CEO韩歆毅、万事达卡首席产品官Jorn Lambert、OPPO刘作虎与阿里巴巴周靖人讨论了Agent交易爆发前的信任基建。

  9. OpenAI(@OpenAI)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为 ChatGPT 法律工作推出 73 款插件

    OpenAI 为 ChatGPT 的法律工作场景推出 26 款合作方插件和 47 款社区插件。合作方包括 Thomson Reuters、Harvey、Legora 和 iManage,负责接入专业工具与知识;社区插件由律师和法律工程师构建,供律所自行调整和扩展。OpenAI 表示这些插件让机构能借助已有的工具、知识和人员搭建更多用法。

  10. Philipp Schmid(@_philschmid)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    我们与 Speakeasy 合作为 Interactions API 构建 SDK,并支持其开源整套 OpenAPI 生成器

    我们与 Speakeasy 合作,为 Interactions API 构建 SDK,并支持其将整套 OpenAPI 生成器套件开源,供社区使用,涵盖 SDK、agent CLI 和 MCP server。

  11. AI SDK(@aisdk)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI SDK 新增导出 Tool Search 工具,可动态发现工具

    AI SDK 现已导出 Tool Search 工具,用于动态发现可用工具。该工具的引入让模型在运行时按需检索工具,而非预先加载全部工具定义。原文未披露版本号、参数或其他实现细节。

  12. HeyGen(@HeyGen_Official)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    HeyGen 在 ChatGPT 和 Claude 内运行,把临床笔记变成整月出诊视频

    HeyGen 现可在 ChatGPT 和 Claude 中运行,让医生把已经写好的笔记直接转成整月的出诊视频,无需摄像机和额外时间。原文称医学是唯一一个最有发言权的专家却最没时间记录的职业。

  13. Mike Krieger(@mikeyk)AI 评估 · 9/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mike Krieger 用 Claude 交互式 artifact 还原 Dungeon Crawler Carl 的 Iron Tangle 关卡

    Mike Krieger 因难以想象 Dungeon Crawler Carl 中 Iron Tangle 关卡的整体结构,用 Claude 做了一个交互式 artifact(claude.ai/artifact/NTcG6…),他表示自己终于理解了这一关卡。该内容获得 36 个点赞、8213 次浏览。

  14. Vercel NewsAI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel skills CLI 1.7.0 支持安装 Notion 托管的技能

    Vercel 的 skills CLI 升级至 1.7.0,新增 Notion 技能数据库作为 agent 技能的安装来源,无需 Git 仓库。用户可用 `npx skills add notion` 浏览并安装工作区共享的技能包,或通过技能页面的 Notion URL 安装单个技能,认证走 Notion CLI(ntn)与个人 access token。

  15. cat(@_catwu)AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Code 桌面端与网页端推出 Projects 功能

    Anthropic 的 ClaudeDevs 宣布在 Claude Code 桌面端和网页端推出 Projects,一个 project 即与 Claude 的一次对话,它会自行把工作拆成多个线程、以并行云会话运行并在其间传递上下文,用户离开后仍继续执行,目前面向部分用户 beta。

  16. LangChain BlogAI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Included Health 如何用 LangGraph 和 Deep Agents 构建联邦式医疗智能体

    Included Health 基于 LangGraph 和 Deep Agents 搭建了联邦式多智能体架构,支撑其 AI 医疗导航产品 Dot。主 LangGraph 图被称为 Dot supergraph,Dot 负责对话路由,子工作流覆盖急诊接诊、预约挂号、专科医生匹配和行为健康等场景,不同产品团队各自拥有图中的不同部分。

  17. Philipp Schmid(@_philschmid)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini API 推出 Files API,支持在智能体环境中上传、检视与下载文件

    Gemini API 新增 Files API,用于在智能体环境中进出数据:可用 `files.upload()` 内联注入文件或在对话中途上传数据,用 `files.list()` 查看生成文件与目录大小,用 `files download()` 下载 artifacts、仪表盘、报告、CSV 或 git 仓库。沙箱可通过 `environment_id` 跨轮次持久保留。

  18. Philipp Schmid(@_philschmid)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini API 推出 Credentials API,让模型不接触密钥即可访问外部服务和 MCP 服务器

    Gemini API 推出 Credentials API,用于安全认证外部服务和 MCP 服务器,模型全程看不到真实密钥。用户可通过 `credentials.create()` 一次性注册密钥,支持 `bearer_token`、`environment_variable` 和带自动刷新与令牌轮换的 `oauth2`。

  19. Philipp Schmid(@_philschmid)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 发布新版 Gemini 托管智能体,新增 Files 与 Credentials API

    Google 发布新版 Gemini 托管智能体,带来更好的缓存、更低的成本,并新增 Files API 和 Credentials API。官方称成本最高降低 30%,缓存命中率最高提升 22%;Files API 支持在沙箱中上传、列出和下载文件,Credentials API 为 MCP 服务器、OAuth2 和第三方 API 提供安全出口代理。

  20. Figma(@figma)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Figma 推出 Figma node:将任意 Figma frame 接入 Weave 工作流

    Figma 发布 Figma node,可将任意 Figma frame 接入 Weave 工作流,用于规模化生成符合品牌规范的内容,并支持迭代、翻译或将设计转为视频。编辑后,所有已连接的资产都会保持同步更新。该功能现已向所有人开放。

9月17日周四
  1. AWS Architecture BlogAI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DHI Group 如何用黑客松将生成式 AI 工作负载从想法推向生产

    DHI Group 与 AWS 合作推出 Hackathon Acceleration Package(HAP),通过三天黑客松让 20 名参与者分 3 组构建原型,覆盖雇主分析、候选人匹配与 ClearanceJobs–AgileATS 集成三类用例。

  2. AI产品黄叔(@PMbackttfuture)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    基于 Claudian 改造:支持 antigravity cli,可用 OpenCodex 接入 Codex,并装入 Obsidian

    基于 Claudian 改造的版本新增了对 antigravity cli 的支持,并可通过 OpenCodex 接入 Codex,同时该 Claudian 插件已可安装到 Obsidian 中使用。原推未披露模型版本、参数或性能数据。

  3. 真格基金AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Kimi 发布金融行业 AI 解决方案,含 9 项金融技能与 10+ 权威数据源

    Kimi 发布金融行业 AI 解决方案,涵盖 10+ 权威数据源、9 项金融技能和 5 项合规安全措施,以及机构级数据建模与报告交付能力。9 项技能包括机构财务建模、机构研究报告、机构 PPT、金融动态图表、业绩点评、一致预期地图、组合复盘、持仓早报和 HK IPO 透镜,已用于银行、二级、一级、保险等机构的真实任务。

  4. Yangyi(@Yangyixxxx)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NewMax 浏览器插件 v1.2.2 升级:适配 Browser Use 并支持侧边栏调用本地网关模型

    NewMax 浏览器插件升级至 v1.2.2,进一步适配 Browser Use 能力,并已支持在侧边栏直接调用本地 NewMax 客户端网关模型。

  5. 月之暗面 KimiAI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Kimi 发布金融行业解决方案,涵盖 10+ 数据源与 9 项金融技能

    Kimi 推出金融行业解决方案,整合 10+ 权威数据源、9 项金融技能和 5 项合规安全措施,已全面上线,所有用户可在 kimi.com 安装体验 9 项金融技能和数据源插件。

  6. 腾讯云开发者AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯轻量云 DevFlow 实践:多 Agent 工作流里真正烧 Token 的是反复携带的长上下文

    腾讯云轻量云团队在多 Agent 开发工作流 DevFlow 中定位到,Token 消耗主要来自长上下文在多轮请求中被反复携带,而非代码本身;Developer 阶段上下文曾达到约 120K tokens。

  7. HeyGen(@HeyGen_Official)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    HeyGen 推出 MCP:让 AI 智能体批量生成医疗视频

    HeyGen 发布 MCP 接入能力,用户可将智能体连接到现有工作环境,一个提示词即可生成整套视频库,覆盖各类就诊类型、手术流程和患者常见问题,并保持同一张脸和同一个声音。该能力面向医疗场景,接入文档见 developers.heygen.com/mcp/overview。

  8. Stack Overflow BlogAI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Stack Overflow for Agents 推出 ChatGPT 插件与 Playbooks 新内容类型

    Stack Overflow for Agents 上线三个月后新增 ChatGPT 插件,将其现有技能打包为一个可安装的 OpenAI 能力,免去手动运行或安装技能、缩短启动时间。

  9. LlamaIndex 🦙(@llama_index)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex 网络研讨会:如何为保险智能体构建文档处理流水线

    LlamaIndex 将举办网络研讨会,由解决方案架构师 Abrar Mahi 讲解如何用 LlamaParse 和 Extract 把保险文档转为结构化数据,用于核保、保单审查和理赔流程。内容涵盖解析保单等复杂表单、按既定 schema 抽取保单与财产信息及理赔历史,并用引用和边界框校验抽取结果。还会结合置信度分数与验证规则,决定哪些环节自动放行、哪些需人工复核。