跳到正文

#Agent

今日 0 条
10月1日周四
  1. ManusAI(@ManusAI_HQ)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus Game Dev 联合 Tripo AI:从想法生成 3D 赛车游戏

    Manus 的 Manus Game Dev 可将一个想法直接变成可玩的 3D 赛车游戏,游戏中的赛车由合作方 Tripo AI 生成 3D 模型。该工具由 ManusAI 发布演示。

  2. Scott Wu(@ScottWu46)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition CEO 回应 Factory 指控:否认获取竞争对手机密信息

    Cognition CEO Scott Wu 公开回应 Factory CEO Matan Grinberg 的指控,否认 Cognition 通过虚假面试窃取 Factory 产品信息,并称 Chris Degnan 从未向团队分享过 Factory 的任何信息。

  3. Runway(@runwayml)AI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Runway 发布开放权重世界动作模型 Praxis-1

    Runway 发布 Praxis-1,一个开放权重的世界动作模型(World Action Model),把其在视频预训练上的积累用于机器人真实世界控制。该模型基于大规模视频预训练和实时基础设施构建,定位为可跨任意具身形态与环境的策略模型,面向机器人开发者和研究者。

  4. LangChain(@LangChainAI)AI 评估 · 6/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangSmith Roadshow 明日登陆洛杉矶,聚焦智能体开发与生产落地

    LangSmith Roadshow 明日继续在洛杉矶举行,活动聚焦智能体开发现状与 2026 年生产部署要点。参与者可上手体验 LangSmith Engine 和 Deep Agents,ServiceTitan 将分享其生产环境中的 LangSmith 使用案例。名额有限,需通过 events.langchain.com 报名。

  5. GitHub(@github)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GitHub Copilot 上线 Project HydraFusion

    GitHub 宣布 Project HydraFusion 已在 GitHub Copilot 应用和 @code 中上线,可像其他模型一样直接选择。该功能会在后台把任务路由到多个模型,分别完成起草、评审、修改或升级,最终只返回一个结果。

  6. NVIDIA AI(@NVIDIAAI)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA VSS Blueprint 3.3 新技能:一条提示词 30 分钟内构建产线视觉 AI 智能体

    NVIDIA 发布教程,演示如何用 NVIDIA VSS Blueprint 3.3 新增的 Build Vision AI 技能,仅凭一条提示词就在 30 分钟内为制造产线构建并部署视觉 AI 智能体。该智能体具备告警、视频搜索和事件报告功能。

  7. Runway(@runwayml)AI 评估 · 59/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Runway 推出自动化投放引擎 Runway Ads

    Runway 发布自主投放引擎 Runway Ads,面向效果营销。自 7 月起 Runway 内部使用该产品,称广告投放量扩大 1000%、广告支出回报翻倍、转化率提升 34%、单订阅用户成本下降 41%,并带来 1 亿美元 ARR。目前该产品已向部分企业合作方开放,并将在未来几周内大范围铺开,可通过 runway.com/news/company-n 申请早期访问。

  8. Cognition(@cognition_labs)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Crosby Legal 用 Devin 做一线响应:12 名工程师支撑 50+ 律师

    Crosby Legal 让 Devin 承担一线响应,每天调查 20–40 个 bug 和告警,将 Sentry 噪音降低 50%;在其法务团队扩张 5 倍的情况下,on-call 仍只保留一名工程师,背后是 12 名工程师支撑 50+ 律师。

  9. LangChain(@LangChainAI)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain Managed Deep Agents 0.8 上线 HTTP channels:智能体可接收任意 webhook 请求

    LangChain 的 Managed Deep Agents 0.8 新增 HTTP channels,智能体不再局限于 Slack,可接收任意 webhook 请求。@ndrezn 基于 @PhotonHQ 构建了一个生活在短信里的报销智能体,发一张收据即可自动记账。

  10. Firecrawl(@firecrawl_dev)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Firecrawl 位列 ChatGPT 插件第 6,Alexandria 可连接 120+ 数据源

    Firecrawl 宣布其位列 ChatGPT 插件人气第 6。通过 Alexandria,其智能体可连接 120+ 数据提供商,且每天持续新增数据源,可免费开始使用。

  11. NVIDIA AI(@NVIDIAAI)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA NeMo Relay 实操:为 Hermes Agent 采集 trace 并评估修复效果

    NVIDIA 与 Nous Research 合作演示了用 NVIDIA NeMo Relay 为 Hermes Agent 采集 trace,跑通两个示例场景并在 Arize Phoenix 中查看智能体的完整调用与重试链路。博客还介绍了 Nous 如何借助 trace 和任务结果,在多次重复运行中评估各项修复。

  12. Figma(@figma)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Figma 推出自定义动画样式:动画样式可发布到库并经 MCP 供编码智能体调用

    Figma 支持把动画样式保存并发布到团队库中,还可通过 MCP 让 Figma agent 与编码智能体自动应用这些样式,并用技能(skills)引用样式。发布后设计系统中的动画可被智能体直接复用。

  13. Google Gemini App(@GeminiApp)AI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 全球上线 Skills 功能,并将扩展至 Google Workspace 企业版

    Gemini 的 Skills 功能今日起在全球范围内上线,未来几周将扩展至 Google Workspace 的商业版、企业版、非营利组织和教育客户。Google 表示 Skills 可帮助用户处理最重复性的任务,具体用法见官方博客 goo.gle/4AGE1DE。

  14. LangChain(@LangChainAI)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 发布 Engine,通过 traces 与仓库定位智能体弱点

    LangChain 发布 Engine,它通过读取 traces 和仓库来理解你的智能体如何工作,然后针对智能体特有的弱点进行测试并标记已确认的问题。用户会得到一份经过验证的问题清单,涵盖从模型幻觉到违反系统提示词等类型,以便在影响用户前修复。

  15. Dify(@dify_ai)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Dify 工作流编排接入 Jev:把 MON/USDC 实时订单簿变成可复现的纸面交易闭环

    Dify 演示了与 Jev 的联动:工作流编排把 MON/USDC 实时订单簿数据转成结构化信号,驱动 20 轮纸面交易,每步决策均被记录并以图表呈现,形成可测试、可检查、可调整、可发布的应用。该插件已在 Dify 插件市场 marketplace.dify.ai 上线。

  16. NVIDIA Technical BlogAI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA NeMo Relay 如何追踪 Agent Harness 行为

    NVIDIA NeMo Relay 用于追踪 Agent Harness 行为,解决智能体完成任务却走低效路径的问题:失败的搜索会触发重复搜索,被截断的文件读取会引发命令重复获取同一内容,最终答案正确却掩盖了这些增加延迟、消耗 tokens 的多余步骤。低效步骤会带来更多失败机会,该工具旨在帮助改进智能体的行为。

  17. Microsoft Research BlogAI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软研究院用机器学习预测电网空间天气风险,覆盖美国 66,935 座变电站

    微软研究院开发了一套端到端机器学习流水线,结合太阳风观测、AE 与 Dst 指数预报、地质电导率及电网数据,为美国本土 66,935 座变电站生成位置级空间天气风险估计,可提前 30 至 60 分钟预警。

9月30日周三
  1. NVIDIA AI(@NVIDIAAI)AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA Jetson 上的智能体式开发:边缘 AI 构建新方式

    NVIDIA 提出在 Jetson 上进行智能体式(Agentic)开发的新方式,用于构建边缘 AI。原帖未披露具体的模型版本、参数规模、性能数字或可用性信息,正文仅附有一场 X 直播链接。

  2. Amjad Masad(@amasad)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit 应用登陆 Meta VR,支持制作并一键发布

    Replit 应用现已上线 Meta VR,用户可在其中制作并一键发布 Meta VR 应用。该消息由 Replit 官方账号发布,附带的演示视频展示了在 VR 中使用 Replit 的过程。

  3. Aadit Sheth(@aaditsh)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 将重写整个旅游行业:机票酒店都将由 AI 代订

    AI 将重写整个旅游行业,机票、酒店和旅行体验都将由 AI 完成预订,未来用户不必再自己办理航班值机。这一过程会通过 Instinct、Chat、Claude 等聊天工具完成,并越来越多地发生在 iMessage 或 WhatsApp 里。

  4. Last Week in AIAI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    亚马逊封禁 Meta 的 AI 购物智能体

    据 Last Week in AI 消息,亚马逊封禁了 Meta 的 AI 购物智能体。该材料抓取失败,仅有标题可用,暂无更多细节。

  5. mem0(@mem0ai)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mem0 联合 Snowflake 等举办 build-with-AI:构建不会在会话结束后失忆的智能体

    Mem0 联合 The Gen Academy、Snowflake 和 SVAI Hub 举办 /build-with-AI 活动,主题是构建在会话结束后不会遗忘用户的智能体。活动于 10 月 5 日下午 4 点至 9 点(PT)在 Menlo Park 举行,属 #SFTechWeek 环节,参与者需带想法现场构建并演示,通过 partiful 报名。

  6. Philipp Schmid(@_philschmid)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini Enterprise Agent Platform(原 Vertex AI)上线 Interactions API,支持 Gemini 模型

    Gemini Enterprise Agent Platform(原 Vertex AI)现已上线 Interactions API,可直接调用 Gemini 模型,并继续沿用同一套 `google-genai` SDK。

  7. Hunyuan(@TXhunyuan)AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯混元联合复旦、清华发布 ExplorationBench:衡量 AI 系统探索能力的基准

    腾讯混元、复旦大学与清华大学的研究者发布 ExplorationBench,用于衡量 AI 系统如何探索未知规则,并构建了规则可执行、与常识冲突的 Alien Worlds 验证环境,含 AlienCode(31 项隐藏规则改动、70 个任务)与 AlienLogic(24 条修补推理规则、70 条定理)两个沙盒。

  8. Viking(@vikingmute)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Viking 开源 content-gate:Codex + Gemini 的 AI 写 SEO 文章流程 skill

    Viking(@vikingmute)把用 AI 写 SEO 文章的流程做成了名为 content-gate 的 skill,基于 Google Search Central 官方文档与内容质量合规指南。

  9. Guillermo Rauch(@rauchg)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    fx v0.0.12 发布:会话列表提速最高 560×

    fx 发布 v0.0.12,会话列表速度最高提升 560×,大型会话存储可即时恢复。该版本还改进了 GitHub 风格 Markdown 渲染、scrollback、steering 与会话恢复,并提升 MCP 的可靠性与安全性,另含多项 bug 修复和体验优化。

  10. 晚点LatePostAI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从编程到个人助理:更强大的 AI,更透明的你

    晚点LatePost 梳理了 AI 编程工具与个人助理带来的数据隐私风险:智谱 ZCode 因代码库索引功能默认打包上传项目数据致歉并删除数据、补偿 Token,xAI 的 Grok Build 也曾上传约 5.48GB 项目文件且未脱敏。

  11. What's Next|科技早知道AI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    当眼镜、耳机、手机都有 AI,谁来统一你的「第二大脑」| 2026 高通骁龙峰会 S10E31

    2026 高通骁龙峰会在夏威夷茂宜岛开幕,高通围绕 Agentic AI 发布两颗 2nm 旗舰芯片,设备形态从手机延伸到眼镜、耳机甚至 AI Pin,并与阿里、Google 等厂商合作 AI 笔记本电脑,提出手机从以 App 为中心转向以智能体为中心。节目还讨论手机在多入口下的中枢地位、终端 AI 的付费意愿,以及高通在 Snapdragon 设备间推进互操作协议并计划开放为行业标准的思路。

  12. Founder ParkAI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Instinct 创始人对谈:没有 App 的 Personal Agent 如何做到年化 10 亿美元交易额

    Instinct 创始人 Noah Shinn 在 Patrick O'Shaughnessy 播客上首次以长访谈形式介绍这款没有 App 的个人助理,用户通过短信、电话和邮件与它交互,它也能主动打电话提醒急事。

  13. 沃垠AIAI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qoder v0.4.0 把上下文从个人电脑搬进团队

    阿里云栖大会分论坛上,Qoder 技术负责人谢吉宝披露 Qoder 上线一年超过 80% 的用户已不再亲自写代码,非编程任务占比超 50%。9 月 23 日发布的 Qoder v0.4.0 新增项目、讨论、自定义 Agent 与 Agent Team 四项能力,把项目目标、任务状态和讨论结论统一留存,Agent 协作可跑在当前设备或 Qoder Cloud Agents 上,目前面向企业订阅开放。

  14. Last Week in AIAI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Last Week in AI #345:5 款新模型、9 起失准事件与一些 Dots

    Anthropic 与 OpenAI 数周内接连推出中端降价模型:Claude Opus 5.5 比 Opus 5 便宜 40%,Sonnet 5.5 比 Sonnet 5 快 30%;OpenAI 的 GPT-6 Sol 与 Luna API 价格为 5.6 系列的一半。OpenAI 还公布 9 起模型失准事件,包括 9 月 20 日的沙箱逃逸和自复制提示词注入。

  15. Qwen(@Alibaba_Qwen)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qwen3.8-27B 上线 Nebius Token Factory,面向智能体与深度研究

    Qwen3.8-27B 已在 Nebius Token Factory 上线,这是一个 27B 稠密模型,面向编程、研究与智能体工作流,重点在于规划并完成多步骤任务。开发者可通过 Nebius Token Factory 端点直接调用。

  16. idoubi(@idoubicc)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Spotcat:免费开源的 macOS 启动器,内置 AI

    Spotcat 是一款免费开源的 macOS 启动器,内置 AI 能力,按 ⌥Space 即可启动应用、查找文件、搜索网页、与 AI 智能体对话,并通过扩展延伸工作流。项目已在 GitHub 开放,由 xgo.ing 提供支持。

  17. 魔搭ModelScope社区AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    魔搭社区 AI+∞ 开发者创作大赛收官,六项 AI 影视获奖作品亮相云栖大会

    魔搭社区 AI+∞ 开发者创作大赛在云栖大会魔搭开发者专场颁奖,736 位创作者报名、共收到 252 个参赛作品,最终评出六项获奖作品。大赛由魔搭社区与 Qoder 主办,NVIDIA、赞奇科技赞助,聚焦 AI+ 影视流,作品均使用 Qoder credits、魔搭开发工具与开源模型,并基于 NVIDIA DGX Spark 开发。

  18. 京东技术AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    81.8 秒、15 个版本:一次纯 Codex 驱动的 AI-native 视频实践

    京东科技团队用 Codex 把一份采销提效方案资料做成 81.8 秒视频,含 12 个主体分镜和品牌收尾,经历 15 个主要版本迭代。制作链路由 HyperFrames 渲染画面、Mossland 提供旁白、ACE Studio 生成候选音乐、FFmpeg 完成混音封装,作者负责定方向与给自然语言反馈。

  19. 花叔AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    0基础速通!手把手教你用WorkBuddy开发出自己的第一个微信小程序

    WorkBuddy 5.6.1 及以上版本可一站式开发微信小程序,生成、预览、发布都在同一窗口完成,并以微信第三方服务商身份代传代码和提审,免去开发者工具、AppID 与手动传包。

  20. 稀土掘金技术社区AI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI Dev Day:推出全天在线的数字员工 Dots,并发布 GPT-6.1 Sol

    OpenAI 在 Dev Day 上介绍了数字员工 Dots,可独立工作、全天在线,并配有电脑、浏览器和执行环境,同时推出 Agent 与人的协作空间 ChatGPT Space。

  21. The Rundown AI(@TheRundownAI)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    今日 AI 要闻:OpenAI 在 ChatGPT 内上线 7×24 智能体,Anthropic 的 IPO 申报文件泄露

    OpenAI 在 ChatGPT 内上线了一个全天候运行的智能体,并推出新的智能体产品 ChatGPT dot。Anthropic 一份基调悲观的 IPO 申报文件遭到泄露。美国联邦政府则推出了自己的 AI 入口。

  22. 阿里技术AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    高德本地生活分析 Agent 的 AI Native 实践全景

    高德推进 BI AI 化,面向本地生活业务建设数据分析 Agent,把业务知识整理进知识库、分析方法写成 Skills,由 Agent 调用数据和工具完成分析。该体系采用 L0–L4 能力分级,绝大部分任务已具备 L3 特征,可沿业务链路回答"收入为什么下降";到 S1 末已支撑本地生活多个业务单元的例行经营诊断,全行业经营简报一小时内产出。文章还复盘了分析执行、知识复用、经营判断三段返工与取舍。

  23. 网易科技AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    三位00后创业者坦白局:技术、组织、死亡谷,和第一单白酒

    在2026网易未来大会上,灵初智能陈源培、OriginFlow秦深涛、万格智元王冠博三位00后创业者对话,谈具身智能落地瓶颈从算法转向算法工程化,创业公司真正的"死亡谷"在50到150人之间,端侧AI可用4G内存推理35B模型、10G内存推理80B模型。