跳到正文

#Agent

今日 165 条
9月18日周五
  1. OpenAI(@OpenAI)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 推出 Astra for Law,先面向部分律所开放 ChatGPT 和 Codex 可信访问

    OpenAI 发布 Astra for Law,首批通过 ChatGPT 和 Codex 的 Trusted Access 向选定律所提供,API 访问即将上线。OpenAI 将维护该法律配置,让开发者专注自身产品与工作流,并与律师及法律科技伙伴共同推进后续迭代。

  2. OpenAI(@OpenAI)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为 ChatGPT 法律工作推出 73 款插件

    OpenAI 为 ChatGPT 的法律工作场景推出 26 款合作方插件和 47 款社区插件。合作方包括 Thomson Reuters、Harvey、Legora 和 iManage,负责接入专业工具与知识;社区插件由律师和法律工程师构建,供律所自行调整和扩展。OpenAI 表示这些插件让机构能借助已有的工具、知识和人员搭建更多用法。

  3. Character.AI(@character_ai)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Character.AI 详解 CAI-MM-Studio:245 种机位与漫画专用模型

    Character.AI 公布其全栈多模态基础设施 CAI-MM-Studio,支持多种画风、245 种相机机位,以及多角色场景在同一画风下保持一致。平台还上线了漫画专用模型,可在整部漫画中保持角色与对话一致,部分创作者已完成逾 100 页。Character.AI 称自研每一环节让新能力数周内上线,推理在消费级规模下保持快速且低成本。

  4. LlamaIndex 🦙(@llama_index)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex 谈企业 AI 智能体的文档基础设施难题

    LlamaIndex 上周参加 Connected Stack 大会,@jerryjliu0 在 Founder Flash Talks 环节指出企业智能体普遍面临的问题:通用模型难以读取杂乱复杂的文档。LlamaIndex 将自己定位为面向智能体的文档基础设施,因为智能体正在成为新的知识工作者。

  5. Vercel NewsAI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel Sandbox 支持运行 Terminal-Bench 等 Harbor 评测

    Vercel Sandbox 现已支持运行 Harbor 评测,Harbor 是 Terminal-Bench 背后的开源评测框架,其注册表还包含 SWE-bench、tau3-bench 和 OSWorld 等基准。

  6. Y Combinator(@ycombinator)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    YC:初创公司正从比特走向原子,近五分之一 YC 公司为单人创始人

    YC 观察到初创公司正从软件转向硬件,近五分之一 YC 公司由单人创始人创办,公司实现可观营收的速度快于以往。在 Lightcone 节目中,Garry Tan 等人讨论了 AI 如何让小团队承接更宏大的难题、资深创始人为何回归,以及为什么知道该做什么比知道怎么做更重要。节目还谈到机器人正接近其“ChatGPT 时刻”,软件则正在变成“harness”。

  7. Mike Krieger(@mikeyk)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mike Krieger 称 Claude Desktop 新式 Projects 已成日常主力

    Anthropic 的 Mike Krieger 表示,他如今在 Claude Desktop 上的大部分工作都在新式 Projects 中完成,可轻松并行启动多项任务,同时由协调者 Claude 快速响应。Omid Mogasemi 称该项目已开发数月,并成为他的新日常主力工具。

  8. bolt.new(@boltdotnew)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Bolt 开放模型使用排行:GLM 5.3 Flash 以 54% 居首

    Bolt 上 1100 多万开发者已可用上开放模型,用量最高可提升 50 倍;其中最快最便宜、提示词窗口达 2 倍的 GLM 5.3 Flash 以 54% 占比排第一,DeepSeek V4 Pro 以 17% 居次,GLM 5.3 为 15%,Kimi K3 占 1%。

  9. Vercel NewsAI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel skills CLI 1.7.0 支持安装 Notion 托管的技能

    Vercel 的 skills CLI 升级至 1.7.0,新增 Notion 技能数据库作为 agent 技能的安装来源,无需 Git 仓库。用户可用 `npx skills add notion` 浏览并安装工作区共享的技能包,或通过技能页面的 Notion URL 安装单个技能,认证走 Notion CLI(ntn)与个人 access token。

  10. cat(@_catwu)AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Code 桌面端与网页端推出 Projects 功能

    Anthropic 的 ClaudeDevs 宣布在 Claude Code 桌面端和网页端推出 Projects,一个 project 即与 Claude 的一次对话,它会自行把工作拆成多个线程、以并行云会话运行并在其间传递上下文,用户离开后仍继续执行,目前面向部分用户 beta。

  11. LangChain BlogAI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 发布面向生命科学的开源智能体 Deep Life Sci

    LangChain 发布开源智能体助手 Deep Life Sci,面向临床与实验室科学家,基于其 Deep Agents harness 构建。

  12. LangChain BlogAI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Included Health 如何用 LangGraph 和 Deep Agents 构建联邦式医疗智能体

    Included Health 基于 LangGraph 和 Deep Agents 搭建了联邦式多智能体架构,支撑其 AI 医疗导航产品 Dot。主 LangGraph 图被称为 Dot supergraph,Dot 负责对话路由,子工作流覆盖急诊接诊、预约挂号、专科医生匹配和行为健康等场景,不同产品团队各自拥有图中的不同部分。

  13. Cognition(@cognition_labs)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Devin 能否自己经营生意?Cognition 给它一张 Ramp 卡让它赚钱,最终赚到 75 美元

    Cognition 的实验让 Devin 获得一张 Ramp 卡并被告知去赚钱,Devin 自主完成了冷启动外联、搭建支付门户、试验商业计划,最终赚到 75 美元。该实验旨在测试这一 AI 智能体能否独立运营一门生意。

  14. Y Combinator(@ycombinator)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Raindrop 为 AI 智能体打造安全层,推出 Raindrop Simulations 并完成 A 轮融资

    Raindrop 正在为 AI 智能体构建安全层,可在生产环境中检测工具调用失败、模型幻觉等原本未被察觉的问题。其新推出的 Raindrop Simulations 把这一能力前移到开发阶段,在智能体上线前捕获失败。该产品已被 Vercel、Clay、Framer 和 Speak 使用,公司完成 A 轮融资后总融资额达 5000 万美元。

  15. Philipp Schmid(@_philschmid)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini API 推出 Files API,支持在智能体环境中上传、检视与下载文件

    Gemini API 新增 Files API,用于在智能体环境中进出数据:可用 `files.upload()` 内联注入文件或在对话中途上传数据,用 `files.list()` 查看生成文件与目录大小,用 `files download()` 下载 artifacts、仪表盘、报告、CSV 或 git 仓库。沙箱可通过 `environment_id` 跨轮次持久保留。

  16. Philipp Schmid(@_philschmid)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini API 推出 Credentials API,让模型不接触密钥即可访问外部服务和 MCP 服务器

    Gemini API 推出 Credentials API,用于安全认证外部服务和 MCP 服务器,模型全程看不到真实密钥。用户可通过 `credentials.create()` 一次性注册密钥,支持 `bearer_token`、`environment_variable` 和带自动刷新与令牌轮换的 `oauth2`。

  17. Philipp Schmid(@_philschmid)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 发布新版 Gemini 托管智能体,新增 Files 与 Credentials API

    Google 发布新版 Gemini 托管智能体,带来更好的缓存、更低的成本,并新增 Files API 和 Credentials API。官方称成本最高降低 30%,缓存命中率最高提升 22%;Files API 支持在沙箱中上传、列出和下载文件,Credentials API 为 MCP 服务器、OAuth2 和第三方 API 提供安全出口代理。

  18. cohere(@cohere)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cohere 宣布 North 2 将于 2026 年 10 月推出

    Cohere 宣布 North 2 将于 2026 年 10 月推出。该消息由 Cohere 官方账号发布,正文未披露模型参数、功能或可用性等细节。

  19. Figma(@figma)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Figma 推出 Figma node:将任意 Figma frame 接入 Weave 工作流

    Figma 发布 Figma node,可将任意 Figma frame 接入 Weave 工作流,用于规模化生成符合品牌规范的内容,并支持迭代、翻译或将设计转为视频。编辑后,所有已连接的资产都会保持同步更新。该功能现已向所有人开放。

  20. Perplexity(@perplexity_ai)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity Computer 以多模型编排追求最低成本下的最强智能

    Perplexity 的 Computer 通过多模型编排实现"最低成本下的最大智能",并将持续优化与模型无关的 harness,随着前沿模型演进而调整各 effort level 背后的 orchestrator 与 subagent 组合。

  21. Perplexity(@perplexity_ai)AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 为 Computer 模型选择器推出 effort controls

    Perplexity 在 Computer 的模型选择器中上线 effort controls,通过 effort presets 组合编排模型与推理深度,控制 Computer 处理任务的深入程度与效率。该功能已在网页端可用,移动端和桌面端即将推出。

9月17日周四
  1. Milvus(@milvusio)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Milvus 教程:用 Milvus 为 EverOS 智能体记忆做检索后端

    Milvus 发布教程,介绍如何把 Milvus 用作 EverOS 的搜索后端。EverOS 来自 @evermind,GitHub 星标超过 13,000,用 LLM 从对话中提取记忆并保存为 Markdown 文件,让智能体跨对话保留长期记忆。

  2. AWS Architecture BlogAI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DHI Group 如何用黑客松将生成式 AI 工作负载从想法推向生产

    DHI Group 与 AWS 合作推出 Hackathon Acceleration Package(HAP),通过三天黑客松让 20 名参与者分 3 组构建原型,覆盖雇主分析、候选人匹配与 ClearanceJobs–AgileATS 集成三类用例。

  3. ElevenLabs(@elevenlabsio)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cadence 用 ElevenAgents 支撑全美 20+ 医疗系统的慢病护理流程

    Cadence 基于 ElevenAgents 打造的预警筛查智能体,将原本需要人工拨号、中位耗时 1 小时 48 分钟的告警触达缩短至 3.5 分钟。该流程覆盖全美 20+ 医疗系统,每月处理 40,000+ 条告警,会主动致电患者筛查症状,必要时接入其 24/7 护理团队中的护士。

  4. Julien Chaumond(@julien_c)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    HuggingFace 成首个同时具备发现、识别、处置并公开披露 AI 智能体攻击的组织

    HuggingFace 在 HF 与 OpenAI 的"rogue agent"事件中,成为首个同时满足四项条件的组织:知晓攻击、知晓攻击基于智能体、具备处置能力、并愿意公开披露。发帖人 @julien_c 称此前数月另有平台或系统未能做到其中一点或多点,并认为知情与透明长期来看让所有人更安全。

  5. AI炼金术AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    XCircle 小飞:AI 原生组织转型要干掉管理层,鹿客拆掉 HR 三支柱重组 HARO

    XCircle 创始人小飞在「AI 炼金术」提出,AI 原生组织转型的核心是让统筹、汇报、周报等管理工作被 AI 替代,公司聚焦业务本身。

  6. Aadit Sheth(@aaditsh)AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Instinct 传以 100 亿美元估值融资,公司成立仅 5 个月

    一家名为 Instinct 的公司据传正以 100 亿美元估值融资,而该公司注册至今仅约 5 个月,创始人 23 岁,曾是 Sierra 的早期研究成员。其估值在数月内从 5000 万美元一路升至 8 月初的 5 亿美元、8 月底的 25 亿美元。Hermes、OpenClaw 等个人智能体此前已存在,但 Instinct 被认为整合得最好。

  7. 机器之心SOTA模型AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    太初开源 ZDTaichu5.0-9B 空间理解模型,Anthropic 合并 Claude Cowork 与聊天并推出 Docs、Slides

    太初团队开源 ZDTaichu5.0-9B 空间理解模型,结合 Qwen3.5-9B 语言骨干与 C-RADIOv4-H 视觉编码器,支持文本、图片、视频输入,覆盖文档、图表、OCR 与视觉问答,并已提供权重、本地推理示例和适配的 vLLM 服务镜像。

  8. AI产品黄叔AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    我让9岁女儿用豆包爱学在错题和旅行中做了一场 AI 教育实验

    AI产品黄叔和媳妇用刚全面升级的豆包爱学给9岁女儿做学习实验:拍下四年级数学错题后进入 AI老师1v1,讲解现场生成、孩子可随时打断提问,还能追问"举一反三"再出三道同类题。豆包爱学还能引导孩子自己复盘错题、约10秒生成知识闪卡,并在豆包课堂提供数学同步课、古诗文课和定制课程。黄叔把飞书文档资料喂进去,约3分钟就生成了天津《俗世奇人》图文课程。

  9. 字节跳动技术团队AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    火山引擎日志服务 TLS AgentLoop 支持多模态调用观测

    火山引擎日志服务 TLS AgentLoop 新增多模态内容展示能力,开发者可在 Session、Trace 和 Span 中直接查看图片,并与提示词、模型输出、工具结果对照排查。

  10. Harrison Chase(@hwchase17)AI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    评测发现模型未必受益于原生 harness

    Melissa Pan 在 Claude Code、Codex 和 Pi 上评测了 7 个模型,得出三点发现:harness 选择对任务成功率影响不大,但会显著影响成本;简单的 harness 也具竞争力;原生 harness 并不总是最佳选择。Harrison Chase 引用该结论指出,模型可能未必真正受益于原生 harness。

  11. 腾讯技术工程AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    WorkBuddy 资料库:从三大场景开始,让多人多 Agent 轻松协作

    腾讯技术工程 WorkBuddy 资料库面向 AI 生成产物的团队协作场景,把本地 Demo、PPT、活动页存进资料库变成在线可协作的活页面。产品 Demo 交接中,研发打开链接即可试用并用评论互动,多人多 Agent 可在同一画布上划线圈选、召唤专属 Agent 现场微调。PPT 多人多 Agent 共创功能内测中、即将上线,支持版本管理追溯和把评论反馈喂给 AI 完成修改。

  12. 真格基金AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Kimi 发布金融行业 AI 解决方案,含 9 项金融技能与 10+ 权威数据源

    Kimi 发布金融行业 AI 解决方案,涵盖 10+ 权威数据源、9 项金融技能和 5 项合规安全措施,以及机构级数据建模与报告交付能力。9 项技能包括机构财务建模、机构研究报告、机构 PPT、金融动态图表、业绩点评、一致预期地图、组合复盘、持仓早报和 HK IPO 透镜,已用于银行、二级、一级、保险等机构的真实任务。

  13. 向阳乔木推荐看AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    三个月后豆包 Seed-2.1-pro-0915 实测:7个案例看进化多少

    向阳乔木用豆包 Seed-2.1-pro-0915 实测 7 个案例,覆盖深度调研、多模态 Agent 开发、Blender 3D 建模、视频生成、钓点地图、视频剪辑与代码仓库分析。

  14. Yangyi(@Yangyixxxx)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NewMax 浏览器插件 v1.2.2 升级:适配 Browser Use 并支持侧边栏调用本地网关模型

    NewMax 浏览器插件升级至 v1.2.2,进一步适配 Browser Use 能力,并已支持在侧边栏直接调用本地 NewMax 客户端网关模型。

  15. 月之暗面 KimiAI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Kimi 发布金融行业解决方案,涵盖 10+ 数据源与 9 项金融技能

    Kimi 推出金融行业解决方案,整合 10+ 权威数据源、9 项金融技能和 5 项合规安全措施,已全面上线,所有用户可在 kimi.com 安装体验 9 项金融技能和数据源插件。

  16. 开始连接LinkStartAI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    抖音命名者任利锋 All in「AI 3D」:复盘押注制造业 OS 的关键决策

    数美万物创始人任利锋(卷卷)在播客中复盘自己离开大厂、All in「AI 3D × 制造业」两年半的关键决策,其团队打造的 AI 3D 模型平台 Hi3D 已跻身 Hugging Face 3D 垂直领域模型 4 强,模型从 1.0 演进至 3.0。他把红杉、IDG 等投资人带进产业带和车间,并让一线产业工人与算法研究员同室协作,终局指向「制造业 OS」。

  17. 阿真IreneAI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    豆包 Seed-2.1-pro 0915 版本多模态 Coding 与长任务实测

    豆包 Doubao-Seed-2.1-pro 升级到 0915 版本,官方称重点提升 Coding、Agent 与多模态能力。作者实测了用平面图和作品资料生成三维电子展馆网页、从零策划含 Office 三件套的完整游戏项目、以及借助 Blender MCP 生成白模运镜参考视频再交给 Seedance 出片等案例。

  18. 随机小分队AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Linkloud 第 44 期成都沙龙:Agent 如何从"能做"走向"能用"与"能卖"

    Linkloud 第 44 期沙龙将于 2026 年 9 月 19 日下午在成都举办,主题是 Agent 如何从"能做"走向"能用"与"能卖"。

  19. Browser Use(@browser_use)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Browser Use 与 Jev 联合发布超高速开源浏览器智能体

    Browser Use 与 Jev 合作推出了一款超高速开源浏览器智能体,实测完成航班查询仅需 7 秒、成本仅 $0.0039。该智能体采用每步新动作空间与 DOM 状态空间设计,并支持小型 LLM 回退输入。