跳到正文

#产品更新

今日 126 条
10月9日周五
  1. DatabricksAI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lakebase 与 Agentic SDLC:为编码智能体打造可分支数据库

    Databricks 发文介绍 Lakebase 与 Agentic SDLC,提出用数据库分支支撑编码智能体工作流。其思路是让编码智能体像操作代码分支一样对数据库进行分支,从而在开发流程中隔离和并行推进变更。

  2. DatabricksAI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Databricks 推出 Funke:原生 HL7v2 解析

    Databricks 发布 Funke,在湖仓中实现 HL7v2 消息的原生解析,无需先转换格式即可处理医疗健康数据。HL7v2 是支撑医疗行业消息传递的标准。

  3. Midjourney(@midjourney)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Midjourney 在 Alpha 网站测试图像生成"思考模式"

    Midjourney 正在其 Alpha 网站(alpha.midjourney.com)测试图像生成的"思考模式",据称可提升提示词准确度、文字排版和画面连贯性。官方邀请用户上传自己的图片参与测试并反馈体验。

  4. eric zakariasson(@ericzakariasson)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok bot 空间不足时,Disk Saver 帮你清理释放空间

    xgo.ing 推出的 Disk Saver 机器人可在你的 grok bot 电脑空间不足时提出清理建议,帮助释放空间。

  5. Anthropic(@AnthropicAI)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 推出 OSS Scanner,用前沿模型免费扫描开源项目漏洞

    Anthropic 推出 OSS Scanner,将用自家前沿模型定期扫描自愿加入的开源项目,排查安全漏洞,且不收取费用。扫描报告会提供概念验证、漏洞说明和修复建议。

  6. Notion(@NotionHQ)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Notion 现已支持 ChatGPT Go 套餐

    Notion 现可接入 ChatGPT Go 套餐,Plus 或 Pro 订阅也能覆盖 Notion 内的 AI 用量。用户只需连接自己的套餐、选择 GPT 模型即可使用。

  7. Lenny Rachitsky(@lennysan)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sundrop:面向家长的私密照片应用

    Sundrop 是一款面向家长的私密照片应用,能找出最佳照片并制成纪念品,支持同岁数对比、成长延时光影等。所有处理都在 iPhone 上进行,照片不上传服务器。

  8. Notion(@NotionHQ)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Baseten 用 Notion Agents 搭建会自我进化的 Slack 答疑系统

    Baseten 基于 Notion Agents 搭建了一套自动答疑系统:问题发到 Slack,答案自动发布,遇到不会的问题会学习并更新所有来源。该系统的工程侧由 Baseten 与 Notion 团队共同推进模型训练与推理,GTM 团队则用 Notion Agents 维护 wiki 的完整与更新。

  9. Notion(@NotionHQ)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Notion 发布智能体构建指南,公开可复用的配方

    Notion 分享了构建 AI 智能体的 cookbook,并公开了可复用的指南链接。该指南发布在 Notion 帮助中心的 guides 页面,供用户参考搭建自己的智能体。

  10. OpenRouter(@OpenRouterAI)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mercury Decide 登陆 OpenRouter:零数据保留端点上线,输入 $0.02/M

    Inception AI 的 Mercury Decide 现已在 OpenRouter 上线零数据保留(ZDR)端点,付费 ZDR 端点与免费端点并存。该模型输入定价 $0.02/M(为 $0.04 标价的 50% 折扣),输出与缓存输入免费,上下文窗口 66K,上周曾是 OpenRouter 上增长最快的决策模型。

  11. Cursor(@cursor_ai)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor 上线 /visualize:在对话中直接生成图表与示意图

    Cursor 现可在对话中直接生成图表和示意图,使用 /visualize 分析数据并在对话内联查看结果,目前已在 Agents Window 中可用。该功能支持在同一对话里继续追问,/visualize 会用新图表作答。

  12. Runway(@runwayml)AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Runway 联手 Claude:用 Claude Motion 做动画再生成视频

    Runway 与 Claude 打通工作流:先用 Claude Motion 制作图表动画、客户演示或简短讲解,再导入 Runway 生成视频和图像。Claude 方面表示,Claude Dashboards 和 Claude Motion 今日进入 beta,可让 Claude 把数据变成实时仪表盘、把想法变成动画讲解。

  13. OpenRouter(@OpenRouterAI)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok Imagine Video 1.5 Lite 上线 OpenRouter 与 Grok Imagine API

    xAI 的 Grok Imagine Video 1.5 Lite 已上线 Grok Imagine API 及 OpenRouter,主打文生视频与图生视频。定价按分辨率计费:480p 为 $0.02/秒,720p 为 $0.03/秒,1080p 为 $0.14/秒。

  14. OpenRouter(@OpenRouterAI)AI 评估 · 69/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenRouter 上线 GPT-6.1 Sol Ultrafast 档位

    OpenRouter 宣布 Sol Ultrafast 已在其平台上线。引用 OpenAI Developers 的信息,Ultrafast 今天面向 GPT-6.1 Sol 的 API、Codex 和 ChatGPT Work 逐步推出,速度最高可达 Sol Standard 的 8 倍,主打接近 Astra 级别的智能水平。

  15. THE DECODERAI 评估 · 70/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 为 Claude 推出 Dashboards 与 Motion 两项 beta 功能

    Anthropic 为 Claude 上线两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。

  16. Notion(@NotionHQ)AI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Notion 推出数据智能体 Data Scout,可连接 Snowflake 并用自然语言查询数据

    Notion 内部最常用的智能体之一是 Data Scout,可连接 Snowflake 与 Notion、Slack 等数据源,让任何人用自然语言提问,并展示答案来源以便核实和深入分析。它还能被其他智能体调用以生成周期性报告,Notion 正帮助一小批客户构建自己的数据智能体。

  17. Claude(@claudeai)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Docs、Slides 和 Design 结束测试并对所有套餐开放

    Claude Docs、Slides 和 Design 即日起结束 beta 阶段,面向包括 Free 在内的所有套餐开放。团队和 Claude 可以在同一份文档、演示稿或设计稿上共同编辑。

  18. Claude(@claudeai)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 支持把仪表盘发到分析工具、把动画发到视频编辑器

    Claude 可将需要深入分析的问题对应的仪表盘发送到你的分析工具,把待完成的动画在视频编辑器中打开。支持的完整工具清单已发布在 claude.com/resources 页面。

  19. Claude(@claudeai)AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Motion 发布:将报告与演示转成动画

    Claude 发布 Claude Motion,可将报告、图表或产品演示转成短动画。每段动画由 Claude 以代码方式生成,不涉及视频模型,因此可修改任意文字、数字或时间点,并导出 MP4。目前面向 Team 和 Enterprise 套餐开放 beta。

  20. Claude(@claudeai)AI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 推出 Dashboards 和 Motion 两项 beta 功能

    Claude 官方宣布 Claude Dashboards 和 Claude Motion 进入 beta。用户可以让 Claude 把数据转成实时仪表盘、把想法转成动画解说。原文未给出更多细节。

  21. elvis(@omarsar0)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Voyager 发布面向视频、图形与游戏的开放 harness

    Anvisha 发布 Voyager,一个面向视频、图形和游戏创作的开放 harness,被形容为创意工作的 Codex。它自带免费的图形、音乐和视频编辑工具,也能在桌面端驱动 Blender、DaVinci Resolve、After Effects、Ableton 等 100 多个应用,并支持 Opus、Astra、DeepSeek 等模型。

  22. AWS Machine Learning BlogAI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    BlockRun 与 Incarna 如何用 Amazon Bedrock AgentCore payments 实现按次推理付费

    Incarna 借助 Amazon Bedrock AgentCore payments,让 AI 智能体逐次向 BlockRun 支付模型推理费用,把接入 x402 支付的工作从数月缩短到数天,并已将端到端按次付费流程投入生产。

  23. OpenAI Developers(@OpenAIDevs)AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为 Codex 和 ChatGPT Work 开放 GPT-6.1 Sol 超高速访问

    OpenAI Developers 宣布在 Codex 和 ChatGPT Work 中开放 GPT-6.1 Sol 超高速访问,Pro 500、符合条件的使用量计费 Enterprise 以及基于额度的 Edu 套餐可用。

  24. OpenAI Developers(@OpenAIDevs)AI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 公布 GPT-6.1 Sol Ultrafast 模式 API 定价

    OpenAI Developers 公布 GPT-6.1 Sol 在 Ultrafast 模式下的 API 定价,为每百万输入 token 12 美元、每百万输出 token 60 美元。该模式面向对速度和智能都有要求的场景,包括排查故障、智能体操作应用,以及每秒都关键的实时体验。

  25. OpenAI Developers(@OpenAIDevs)AI 评估 · 70/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为 GPT-6.1 Sol 推出 Ultrafast,API、Codex 和 ChatGPT Work 上线

    OpenAI 开发者账号宣布,GPT-6.1 Sol 的 Ultrafast 于当日开始在 API、Codex 和 ChatGPT Work 中上线。官方称该档位提供接近 Astra 的智能水平,速度最高可达 Sol Standard 的 8 倍。

  26. 技术前沿AI 评估 · 77/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 在 Gemini 中引入智能体能力,先从企业客户开始

    Google 在 Cloud 活动上宣布将 Gemini 带入智能体阶段,推出统一智能体,既能回答问题也能代用户完成任务,初期面向企业、之后再向消费者开放。该智能体可接收目标而非指令,自行规划工作并调用自定义技能与工具;默认自动选择模型,用户也可手动切换,首批第三方模型为 Anthropic 的 Claude。

    为什么值得看

    Google 把 Gemini 智能体先落到企业场景,文中给出的模型选择、系统连接与审计线索可供评估落地边界。

  27. Sundar Pichai(@sundarpichai)AI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 发布面向工作场景的 Gemini agent

    Google 在 NASA Hangar One 面向 700 多名 Google Cloud 客户的活动上发布新的 Gemini agent,是一个面向工作的统一智能体,可在单一提示框中回答问题、处理知识工作、生成图像与媒体、编写并运行代码。

  28. Windsurf(@windsurf_ai)AI 评估 · 9/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Windsurf 分享 Devin 试用链接

    Windsurf 在 X 上发布 Devin 的试用链接,指向 docs.devin.ai 的 "work-with-devin" 文档页面,未披露模型版本、参数或价格等细节。

  29. OpenRouter(@OpenRouterAI)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenRouter:Ori 自动切换低成本模型,交易成交提速 34%

    OpenRouter 披露数据显示,Ori 让交易成交周期从 71 天缩短至 47 天,提速 34%,成交率提升 2.6 倍。随着 Ori 自动换用质量达标但成本更低的模型,成本还会随时间下降。Ori 的 Slack 智能体即将面向所有人上线。

  30. OpenRouter(@OpenRouterAI)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenRouter 分享:demo 准备工作耗时从 75 分钟降至 14 分钟

    OpenRouter 分享数据显示,每场 demo 的准备工作从 75 分钟缩短至 14 分钟:准备 30 分钟→5 分钟、笔记 15 分钟→2 分钟、CRM 30 分钟→7 分钟。每通电话省下约 1 小时,每位销售每天可多接约 2 通电话且准备度不变。

  31. GitHub(@github)AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GitHub 推出上下文感知密钥分类器,2 毫秒内识别待推送密钥

    GitHub 推出上下文感知分类器,可在 2 毫秒内检查候选密钥,有望让推送保护在密钥进入仓库历史前拦截的数量翻倍以上。GitHub 称开发者和智能体的操作速度前所未有,密钥保护需要同步跟上。

  32. 国际大厂AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Amazon 弃用 Fire 品牌推出 Alexa Tablets,全面转向 Google 认证 Android

    Amazon 发布全新 Alexa Tablets 平板线,放弃 Fire 品牌,并首次成为 Google 认证的 Android 设备,预装 Play Store 与 Google 应用。

  33. 国际大厂AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Amazon 2026 年 10 月新品汇总:Alexa 平板、Kindle 与 Ring 设备

    Amazon 在 2026 年 10 月已陆续公布 Alexa 平板、新款 Kindle、Ring 智能家居设备和更新版 Fire TV Stick 4K。

  34. Aravind Srinivas(@AravSrinivas)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity Computer 为 OpenAI 数学手稿的 722 篇预印本生成讲解视频

    Perplexity Computer 为 OpenAI 数学手稿发布中的全部 722 篇预印本生成了讲解视频,总时长 93 小时,并整理成 YouTube 播放列表(722.video)。用户可在 722.video 观看这些视频,官方还说明了 Computer 完成该任务的方式。

  35. Fish Audio(@FishAudio)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fish Audio 开放 Drama 3 Preview API:模型名设为 drama-3-preview

    Fish Audio 开放 Drama 3 Preview 的 API 访问,调用时需将 model 设为 [drama-3-preview],API key 可在 fish.audio/app/api-keys 获取。网页端使用入口为 fish.audio/app/text-to-sp…,模型选择 Fish Audio Drama 3 (Preview)。

  36. bolt.new(@boltdotnew)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    bolt.new 一条提示词生成完整播客剪辑播放器

    bolt.new 用一条提示词生成了一个完整的播客剪辑播放器,支持可拖动波形、可点击跳转的章节标记,以及生成后再调整样式的可视化编辑器。

  37. Fish Audio(@FishAudio)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    开发者用 Fish Audio Drama 3 打造 AI 对话语言练习应用,角色会不耐烦

    开发者 @whosamberella 做了一款用 AI 语音练习真实对话的语言应用,每个角色有独立性格,还附带面向初学者的发音卡片,对话中角色甚至会因为你说不对而变得不耐烦。所有语音均由 AI 生成,使用 Drama 3 构建。

  38. Aravind Srinivas(@AravSrinivas)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity Decider V1.1 在 DecisionBench 排名第一且成本最低

    Perplexity 的 Decider V1.1 在 decisionbench.ai 上以 93.9% 准确率排名第一,成为成本最低的方案。在 949 个共享文本用例中,其决策中位延迟为 534 ms,价格为 $0.016 / 1k decisions。

  39. LangChain(@LangChainAI)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 推出办公用品采购智能体 Restock,可在 Slack 内下单并人工审批

    LangChain 构建了一款名为 Restock 的办公用品采购智能体,运行在 Slack 中,用户可在 Slack 里提出需求、查看订单,并通过 Stripe 的 Link agent wallet 完成审批付款,每笔订单都需人工确认。该应用支持搜索真实商品、准备购买并支付,基于 MPP + Managed Deep Agent 构建。

  40. 技术前沿AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Goodfire 推出“由内而外”的 AI 智能体监控器,成本仅为传统方案零头

    Goodfire 发布了一种“由内而外”的监控方案,直接读取 AI 模型工作时的内部激活信号,而非让第二个模型逐字审阅输出。在 Kimi K3 上测试约 1500 个会话,成本约 51 美元,而廉价模型逐步检查需 233 美元、顶级模型约 1 万美元;探针捕获了 94% 的恶意黑客会话,并将 8.7% 的无害会话送二审,同时运行四个探针给模型响应启动时间增加不到 2%。