跳到正文

#产品更新

今日 0 条
10月2日周五
  1. Pika(@pika_labs)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Pika 推出 Camera Director:可在保持原始内容的前提下重构任何镜头

    Pika 上线 Camera Director,能在保持原始内容不变的前提下对任意镜头重新取景,从不同角度呈现同一画面。该功能被视为对已有素材的实用补充,可在拿到满意片段后换视角展示,用户反馈画面质量令人印象深刻。

  2. DockerAI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Docker 发布 Cloud Sandboxes 与开放 Sandbox Kit 规范

    Docker 在 WeAreDevelopers World Congress North America 上发布 Cloud Sandboxes,为智能体提供隔离 microVM 运行环境,开发者可用同一命令行工具 sbx 在本地启动、将沙箱迁移至云端长时间运行再取回结果,计算按秒计费,目前可用。

  3. NVIDIA Technical BlogAI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA 推出 DOCA Agent Skills,加速在 BlueField 上构建应用

    NVIDIA 发布 DOCA Agent Skills,为通用 AI 智能体补上 DOCA 这一基础设施软件领域的专业知识,减少其在开发中因缺乏领域知识而产生的猜测性错误,从而缩短反复纠错占用的时间。DOCA 是 NVIDIA BlueField 的统一软件平台,该技能面向在 BlueField 上构建应用的开发者。

  4. Claude(@claudeai)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 推出设计、演示与文档自动应用功能,Pro/Max/Team 计划可用至 10 月 15 日

    Claude 在创建 design、deck 或 doc 时自动应用该功能,活动持续至 10 月 15 日,面向 Pro、Max 和 Team 计划用户。具体运作方式与完整条款见 support.claude.com 上的支持文章。

  5. Claude(@claudeai)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 应用推出两周用量减免,配合 Claude Sonnet 5.5 生成设计与演示稿

    Claude 官方宣布,为期两周内在 Claude 应用里开始设计稿、演示文稿或文档,该对话后续工作只消耗 50% 的用量额度。官方建议配合 Claude Sonnet 5.5 使用,称其对设计有较强的把握,生成的幻灯片几乎无需再编辑。

  6. Replit ⠕(@Replit)AI 评估 · 14/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit 谈自驱型公司:自建定制工具,无需购买通用方案

    Replit 提出「自驱型公司」愿景:团队自行构建定制工具以满足自身需求,无需在市场上购买通用方案。Replit 在官方博客中展示了这一模式在其内部的具体实践。

  7. The Rundown AI(@TheRundownAI)AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Tavus 发布人类交互模型 Griffin,直播测试中 48% 的人误认为是真人

    Tavus 发布名为 Griffin 的"人类交互模型",公司称其通过了视频图灵测试。在与它实时对话的人中,48% 认为对方是真人,而早期模型这一比例不到 3%。

  8. HeyGen(@HeyGen_Official)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    HeyGen 发布三款开发者工具:开源实时数字人栈、Code2Video Benchmark 与 API 专业语音克隆

    HeyGen 在 9 月为开发者推出三款工具:一个基于 OpenAI GPT-Live-1 的开源实时数字人技术栈,与 Kaggle 合作的 Code2Video Benchmark(用于衡量 AI 生成视频的质量),以及面向 API 的专业语音克隆。

  9. OpenAI Developers(@OpenAIDevs)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI Developers 发布 dots demo:WiFi 连接改进

    OpenAI Developers 放出一段 dots demo 演示,称此次版本"WiFi 更好"。该演示推文获得 1703 条回复、850 次转发、19251 次点赞和 838 万次浏览,被 4534 次引用。原文未透露 dots 的具体功能、模型版本或技术细节。

  10. Lovable(@lovable_dev)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovable 上线 Talk to Rocky:网页直连对话应用

    Lovable 推出对话应用 "Talk to Rocky",可通过 talk2rocky.lovable.app 直接访问使用。该链接由 xgo.ing 提供支持。

  11. Lovable(@lovable_dev)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovable 应用可接入 OpenAI GPT-Live 实时语音对话

    Lovable 用户现在可以为自己的应用添加由 OpenAI GPT-Live 驱动的实时语音对话功能。官方演示中,@mgfeller 用它做出了能与《Project Hail Mary》角色 Rocky 对话的应用。该功能支持直接接入 Lovable 构建的应用。

  12. Google DeepMind(@GoogleDeepMind)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 播客探讨 AI 内容溯源与 SynthID 隐形水印

    Google DeepMind 在播客中探讨 AI 生成内容愈发逼真后如何验证内容来自人类、机器还是自然,重点介绍隐形水印在溯源中的作用。节目覆盖 SynthID 及其在图像与视频中的应用,并延伸至面向生物设计的 SynthID Bio。

  13. GitHub(@github)AI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GitHub 推出 gh-secure:一条命令防止密钥泄露到公开代码

    GitHub Security Lab 发布 gh-secure,只需一条命令即可阻止密钥泄露进公开代码,为仓库提供基础安全防护。该工具可在 Copilot 应用、Copilot CLI 或 GitHub CLI 中安装使用。

  14. Fish Audio(@FishAudio)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Sonnet 5.5 搭配 Fish Audio MCP:一张海报生成 10 秒短片

    Fish Audio 演示 Claude Sonnet 5.5 配合 Fish Audio MCP 完成艺术指导:从一张海报直接生成 10 秒短片,包含标题和声音,全程在同一个对话中完成,图像与视频生成均由 Fish Audio MCP 承担。

  15. Notion(@NotionHQ)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Notion 支持 ChatGPT 与 Notion 账号邮箱不一致时共享 token

    Notion 上线 token 共享功能,ChatGPT 与 Notion 账号使用不同邮箱地址也能完成设置。此前一天有用户提出该需求后即完成开发并发布。ChatGPT Plus 或 Pro 订阅可覆盖 Notion 中的 AI 使用额度,连接套餐后即可选择 GPT 模型使用。

  16. Mustafa Suleyman(@mustafasuleyman)AI 评估 · 14/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软 Foundry 上线全部模型,并接入 Vercel 与 OpenRouter

    所有模型即日起在 Microsoft Foundry 中可用,同时接入 Vercel 和 OpenRouter 等日常工具。原文未披露具体模型名称、版本号或参数规模等细节。

  17. OpenRouter(@OpenRouterAI)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenRouter 推出 IP allowlist,管理员可限制 API 访问来源 IP

    OpenRouter 上线 IP allowlist 功能,管理员可将 API 访问限制在已批准的 IP 地址范围内,来自其他地址的请求将被直接拦截。该功能面向需要收紧 API 调用来源管控的管理员。

  18. OpenRouter(@OpenRouterAI)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenRouter 推出 Key Safety 标签页,跨工作区统一管理 API keys

    OpenRouter 的 Key Safety 标签页可集中查看所有工作区的 API keys,并支持按风险、所有者和不活跃状态筛选。用户还能为 key 设置额度上限、禁用或归档,既可逐个操作也可批量处理。

  19. OpenRouter(@OpenRouterAI)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenRouter Security Center 上线:三个标签页帮你排查高风险 API Key

    OpenRouter 的 Security Center 提供 Overview、key safety 和 IP allowlist 三个标签页。其中 Overview 按无消费上限、无有效期、90 天以上未使用、可安全删除等风险对 API Key 分组,并给出对应处理建议,用户可直接在 Security Center 中定位并修复高风险 key。

  20. Figma(@figma)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Figma 移动端上线更流畅的导航与协作功能

    Figma 移动端迎来更流畅的导航与协作体验,官方已放出下载入口和演示视频。具体功能细节与版本号原文未披露。

  21. OpenRouter(@OpenRouterAI)AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软 MAI-Voice-2.1-Flash 上线 OpenRouter,150ms 生成 45 秒音频

    微软 MAI-Voice-2.1-Flash 已在 OpenRouter 上线,主打速度与规模:可在 150ms 内生成 45 秒音频,支持同一音色用 23 种语言说话并保持母语口音,定价为每 100 万字符 15 美元,面向语音智能体、助手、呼叫中心等实时场景。

  22. Aravind Srinivas(@AravSrinivas)AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity Computer 上线内联图表、示意图与可视化,接入 TradingView 金融图表

    Perplexity 的 Computer 功能新增内联图表、示意图与可视化,可直接在对话线程中生成交互式图表。金融数据部分由 TradingView 的 Lightweight Charts 驱动,支持 K 线、成交量和移动平均线。

  23. Jerry Liu(@jerryjliu0)AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex 推出 Extract v2.5 文档抽取智能体,性能超 Opus 5.5 与 GPT-6 Sol

    LlamaIndex 发布 Extract v2.5,一组专为文档抽取调优的前沿智能体,分为 cost-effective、agentic、agentic plus 三档,价格比 Opus 5.5 和 GPT-6 Sol 便宜 30%-4x。

  24. Perplexity(@perplexity_ai)AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity Computer 支持在对话中直接生成交互式图表与可视化

    Perplexity Computer 现在可在对话线程中直接生成交互式图表和可视化。针对金融数据,Computer 使用 TradingView Lightweight Charts 绘制 K 线、成交量和移动平均线。

  25. Firecrawl(@firecrawl_dev)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Firecrawl Alexandria 持续接入更多数据提供商,上线人物信息增强功能

    Firecrawl 的 Alexandria 正在持续接入更多数据提供商,并已上线人物信息增强(people enrichment)功能,用户可在 firecrawl.dev/app/alexandria 开启使用。官方表示后续还会有更多数据包陆续推出。

  26. Firecrawl(@firecrawl_dev)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Firecrawl 推出 People Enrichment Pack,Apollo、FullEnrich 与 Data Legion 上线 Alexandria

    Firecrawl 发布 People Enrichment Pack,Apollo、FullEnrich 和 Data Legion 已在 Alexandria 上线,可让智能体查找买家及其工作邮箱、按技能和任职经历筛选人才,并获取公司规模与融资信息。该功能现可在 Claude、ChatGPT 或 Firecrawl API 中试用。

  27. Runway(@runwayml)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Runway Labs 推出 Project Continuum:围绕实时视频界面的操作系统研究应用

    Runway Labs 发布 Project Continuum,一款围绕实时视频界面构建的操作系统研究应用,同时展示能"在你所在之处与你相遇"的界面早期形态。官方放出了完整的演示视频。

10月1日周四
  1. NVIDIA AI(@NVIDIAAI)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 NVIDIA Cosmos 和 VSS 3.3 从一条提示词构建视觉 AI 智能体

    NVIDIA 发布基于 Cosmos 和 VSS 3.3 的方案,可通过一条提示词构建视觉 AI 智能体。该内容以直播形式呈现,具体功能与参数未在原文中披露。

  2. OpenRouter(@OpenRouterAI)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenRouter 安全功能全套餐可用,左侧导航栏 Security 即可试用

    OpenRouter 宣布该安全功能已在所有套餐中可用,用户可从左侧导航栏进入 Security 试用,或查阅官方文档。帖文未披露具体功能名称与细节。

  3. OpenRouter(@OpenRouterAI)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenRouter 推出 Security Center,审计发现 85 名员工持有 1000+ 个活跃 API key

    OpenRouter 审计自家账号时发现,85 名员工名下有 1000+ 个活跃 API key,其中许多已数月未被使用。为此其推出 Security Center,可展示各工作区中的所有 key 并标记风险原因,支持批量禁用、归档或设置上限,单次最多处理 500 个。

  4. mem0(@mem0ai)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mem0 如何让 Claude Code 不再每次重新解释代码库

    Mem0 可让 Claude Code 无需在每个会话中重新解释代码库。该内容为一条推文式演示,未披露具体实现细节、版本号或性能数据,原文仅附视频入口与互动数据。

  5. Runway(@runwayml)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Runway 将任意媒体扩展为可交互的实时世界模拟

    Runway 推出新能力,可将任意媒体扩展为交互式实时世界模拟,把固定体验转变为面向人和 AI 智能体的沉浸式多模态模拟。原文未披露模型版本、参数规模或可用性细节。

  6. Runway(@runwayml)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Runway 发布 Project Continuum:围绕实时视频界面的操作系统研究应用

    Runway 旗下 runwayml_labs 推出 Project Continuum,一个围绕实时视频界面的操作系统研究应用。官方展示了四种与电脑交互的新方式:Portals、Visual Thinking、Responsive Video Interfaces 和 Interactive Worlds。

  7. Hugging Face(@huggingface)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MCP 回归:现在可用 MCP 把数据接入 Hugging Face Chat

    Hugging Face 宣布 MCP 回归,用户现在可以通过 MCP 把自己的数据接入 Hugging Face Chat。该功能面向 hf.co/chat 的 ml-intern 模式开放。

  8. Aravind Srinivas(@AravSrinivas)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity Computer 集成 Seedance 2.5,为营销与品牌团队生成商业视频

    Perplexity Computer 现已集成 Seedance 2.5,营销与品牌团队可在其中为小企业生成商业或品牌视频,品牌视觉、产品样机和完整视频剪辑全部在 Computer 内完成。

  9. Recraft(@recraftai)AI 评估 · 6/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Recraft 分享三组提示词:古怪旅人、巨型花束与悬浮巨鱼

    Recraft 展示三组图像生成提示词:一位背着巨大背包、围着长围巾的高个古怪旅人站在微型未来载具旁;一位女子怀抱大到完全遮住头与上半身的巨束花,只露出外套、双手和鞋子;一条巨鱼横浮在小村庄上空,背上落满小鸟。

  10. Recraft(@recraftai)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Recraft V4 Styles:同一个视觉起点,探索完全不同的角色、物体与场景

    Recraft 展示用 Recraft V4 Styles 从同一视觉起点出发,生成完全不同的角色、物体和场景,提示词放在评论区。该演示强调无固定终点、多样化的创作探索方向。

  11. LovartAI(@lovart_ai)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovart 用 GPT-Image 2.5 + Seedance 2.5 实现单图生成多角度实时场景

    Lovart 展示了一套由 GPT-Image 2.5 与 Seedance 2.5 驱动的工作流,只需一张图像即可生成虚构场景的多个视角,并让画面实时动态呈现。该演示由 Lovart 制作完成。

  12. Lenny Rachitsky(@lennysan)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 订阅现可直接用于 16 家以上合作伙伴产品

    ChatGPT 订阅额度现可直接在 16 家以上合作伙伴产品中使用,无需额外规则,包含 Devin、OpenCode、Notion 等,通过 Sign in with ChatGPT 登录即可使用。该消息由 Tibo 发布,Lenny Rachitsky 转发并称其为 DevDay 的意外亮点。

  13. LangChain(@LangChainAI)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 用 OpenSWE Review 评测自有智能体:精度升至 81.5%、工具调用减少 29%

    LangChain 在两个自研智能体上测试 OpenSWE Review,其精度从 62.9% 提升至 81.5%,每次审查的工具调用减少 29%。基于 Kimi K3 微调的 Engine 在问题检出基准上超过了基座模型与 GPT-5.6 Sol。相关细节见 LangChain 博客。