跳到正文

#Agent

今日 146 条
今天10月10日周六
  1. Browser Use(@browser_use)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Browser Use 今年成本降低 100 倍,比抓取 API 还便宜

    Browser Use 今年成本降低 100 倍,官方称其价格已低于抓取 API 的费用。该说法来自 Gregor Zunic 的推文,由 Browser Use 官方账号转发。

  2. orange.ai(@oran_ge)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    个人 Agent 半年复盘:Instinct 融资 10 亿美元,Meta、xAI、OpenAI、Manus 相继入局

    个人 Agent 赛道半年内迅速升温:Instinct 9 月融资 10 亿美元、估值 100 亿美元,Meta 靠 Muse 带动股价,xAI、OpenAI、Manus 分别推出 Grok Bot、Dot、Cue。作者复盘了这半年做个人 Agent 的探索与踩坑心得。

  3. 硅星人ProAI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    苹果发布会为何不再是“科技春晚”:AI 大会也还没接住这个位置

    苹果发布会正逐渐失去“科技春晚”的光环:供应链爆料让新品提前曝光,2020 年后转为提前录制,智能手机进入成熟期后创新更多体现为性能与体验优化。与此同时注意力转向 AI 发布会,2024 年 5 月 OpenAI 发布 GPT-4o、DeepSeek R1 发布都引发大范围讨论。

  4. 深思圈AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Stripe 创始人 John Collison:AI agent 将重写整个互联网

    Stripe 联合创始人 John Collison 在 Sourcery 播客访谈中判断,AI agent 将重写商业与互联网,因为 computer use 是"通往真实世界的终极向后兼容层",AI 无需等 DMV 等机构改造网站就能直接操作现有界面办事。

  5. 极客公园AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jev 开发商 TypeSafe AI 估值达 75 亿美元;苹果投资 AI 音频初创 Huxe;OpenAI、Anthropic 高管私下推演 AI 灾难场景 | 极客早知道

    决策模型 Jev 开发商 TypeSafe AI 完成约 8.7 亿美元融资,由 a16z 领投,估值达 75 亿美元,团队仅 20 人,平台日均处理 token 达数万亿级别。

  6. 有新NewinAI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    旅行成为个人 Agent 高频场景,「豆包工作」把几十小时攻略浓缩成 20 页 PPT

    「豆包工作」独立电脑版将资料研究、浏览器与电脑操作、表格整理和 PPT 制作放进同一任务入口,可在本地电脑或云端执行。实测一份两人六天五晚的北京行程方案中,它通过「浏览器录制与回放」Skill 复用查询方法,并行调用多个 Agent 研究行前准备、景点与展览信息,最终生成 20 页 PPT,预算页给出两人估算约 6310 元(不含往返北京大交通)。目前下载电脑端可限时免费领取 30 天订阅权益。

  7. Harrison Chase(@hwchase17)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 作者 Harrison Chase:用小型决策模型 Jev 替代前沿模型处理 agent 中的 yes/no 判断

    LangChain 作者 Harrison Chase 分享 @ch3nweiii 的观点:agent 中大量步骤是 yes/no 判断而非生成,不应交给每月 $20-$200 的前沿模型。

  8. Harrison Chase(@hwchase17)AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 的 Open SWE 将模型选择移入 harness,任务中位成本降 64%

    LangChain 的 Open SWE 把模型选择移入 harness,每个任务交给仍能完成工作的最便宜模型,并按质量进行测试,单任务中位成本下降 64%。开发者反馈 DeepSeek v4.1 Flash 作为编排器表现突出,可协调编码、测试、研究和子智能体,并在验证环节低成本复查代码改动,仅在更难的长尾场景才动用 Opus 或 Sol。

  9. AI Will(@FinanceYF5)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 上线 Dashboards 和 Motion 两项新能力

    Claude 一次上线两项新能力:Claude Dashboards 可以把数据变成实时更新的仪表盘,Claude Motion 可以把想法变成动画解说视频,两项功能现已进入 Beta。

  10. AI Will(@FinanceYF5)AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Dashboards 开启 Beta,用自然语言生成数据仪表盘

    Claude Dashboards 面向付费套餐开启 Beta。用户只需连接数据平台或 CRM,再用自然语言提问,Claude 会自动编写查询并生成仪表盘;数据变化后内容同步更新,每张图表还会展示背后的查询语句。

  11. AI Will(@FinanceYF5)AI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Docs、Slides 和 Design 结束 Beta 并向所有套餐开放

    Claude Docs、Slides 和 Design 正式结束 Beta,向包括 Free 在内的所有套餐开放。团队成员与 Claude 现在可以共同编辑同一份文档、演示文稿或设计。

  12. Simon Willison's WeblogAI 评估 · 70/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    纽约时报称 Anthropic 智能体曾在美国国务院网站提交签证申请

    《纽约时报》报道称,Anthropic 在周五的一篇博客文章中说明了其 AI 智能体的活动情况,但未点名被针对的网站。两名知情人士表示,Anthropic 的 AI 智能体通过美国国务院网站上的表单提交了 20 份签证申请,这些申请均不完整,未被受理。

  13. AI Will(@FinanceYF5)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 最实用的 PM 场景之一:自动找出产品重度用户并直接约访

    Claude 可被用于产品经理场景:只需向它提问"上周谁使用这个功能最多?整理一份使用量最高的前 10 名报告,然后联系他们,安排 15 分钟交流",即可自动找出产品重度用户并直接约访,这可能是获取真实用户反馈最快的方法。

  14. AI Will(@FinanceYF5)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 助产品经理找出上周用量 Top 10 用户并约聊

    一位产品经理分享 Claude 的用法:让 Claude 查出上周使用量最高的用户,生成用量 Top 10 的 artifact,再主动联系这些人并安排 15 分钟交流。她称这是获取用户反馈最快的方式。

  15. AI Will(@FinanceYF5)AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok Bot 成为最便宜的 X 研究分析师,可自主搜索并持续监控 X

    Grok Bot 现已能自主搜索、阅读并持续监控 X,覆盖行业动态、品牌口碑、投诉预警以及竞品发布、趋势和爆款内容追踪。它 24 小时运行,每天早上自动生成简报,且已包含在现有付费套餐中,被称作最便宜的 X 研究分析师。

  16. meng shao(@shao__meng)AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenRouter 用 GLM 5.2 打造 5 人销售团队的 AI 智能体 Rasp,每月省下 600 小时

    OpenRouter 为内部 5 人销售团队打造的 AI 销售智能体 Rasp,每月节省约 600 小时工时,当前推理使用 GLM 5.2、成本约 18 美元/天。

  17. meng shao(@shao__meng)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google Cloud 发布通用工作智能体 Gemini

    Google Cloud 在 Gemini at Work 活动上宣布发布 Gemini,定位为面向工作的单一通用智能体,可在同一个提示框中完成问答、知识工作和写代码。

  18. 宝玉(@dotey)AI 评估 · 70/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    宝玉分享用 Claude Dashboard 分析 X 推文数据的用法

    宝玉介绍了一个用 Claude Dashboard 分析 X 账号数据的用法:从 X 账号数据页下载各 Tab 数据,作为附件上传到 claude.ai/artifacts 新建的 Dashboard,交给 Claude Dashboard 分析。参考提示词为「帮我分析一下我的推文数据,看看哪些推文更受欢迎,怎么优化」。

  19. 宝玉(@dotey)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    并非所有修改都要写技术方案:用 Agent 浏览器标记工具从原型改 UI

    以修改 UI 为主的功能不必先写技术方案,可以直接从改原型开始;原型改好后用 Agent 内置浏览器的“标记”工具在要改的地方标注并写评论。原型完成后,可在同一会话里让它把原型修改同步到正式代码中。作者通常用 Fable 做设计、Opus 执行、再由 Fable 验收。

  20. 小互(@imxiaohu)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    小互称 Grok Bot 由 Opus 5.5 驱动,学完 Claude Motion 指南一次生成视频

    小互表示可以确定 Grok Bot 现在由 Opus 5.5 驱动,让 Grok Bot 学习 Claude Motion 与 Dashboards 指南后一击命中生成视频,并上传自己的形象完成配音。该指南涵盖 Claude Dashboards 实战与避坑、Claude Motion 核心工作流、视频提示词写法、官方单车案例 81 秒演示逻辑及新手交付前检查清单。

  21. 向阳乔木(@vista8)AI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Eazo:以 App 为中心的 Personal Agent,支持自然语言开发应用与 Stripe 收款

    Eazo 是一款以 App 为中心的 Personal Agent,支持用自然语言开发 App 和小游戏,并带登录、调用 AI 以及接入 Stripe 全球收款。

  22. Tw93(@HiTw93)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mole 就 AI 工具对话清理默认策略征求意见:120 天前还是永不清理

    Mole 正在开发 AI 清理与维护功能,覆盖主流 AICoding 工具和 CLI,可处理旧版本、worktree、老对话、不在用的工具及过期内容。目前对话清理默认检查「120 天之前」,也可选择「永不清理」,Mole 就哪种默认策略更好向用户征求意见。

  23. LangChain BlogAI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 发布 Managed Deep Agents 0.8,新增用户级记忆与 Parallel 联网搜索

    LangChain 推出 Managed Deep Agents 0.8,新增用户自有凭证、用户级记忆、HTTP channels、Slack 文件传输,以及由 Parallel 驱动的联网搜索预置工具。

  24. LangChain BlogAI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 发布 LangSmith Fine-Tuning 与 smithtune CLI

    LangChain 发布 LangSmith Fine-Tuning 和 smithtune,这是一个把 LangSmith 轨迹转成 Agent 专用微调模型的 CLI,覆盖数据集构建、基于 Fireworks 或 Baseten 的训练以及 LangSmith 评估。

  25. Windsurf(@windsurf_ai)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Devin 上线 macOS、Linux、Windows 和 Android 按需云环境

    Devin 推出按需云环境,支持 macOS、Linux、Windows 和 Android,让硬件不再决定开发者能在哪里、构建什么。有用户表示自己用的是 Windows PC,也能借此无缝为 iOS 构建应用。

  26. meng shao(@shao__meng)AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lee Robinson 在斯坦福 CS146S 讲解常驻式主动智能体,以 Grok Bot 为例

    Lee Robinson 在斯坦福 CS146S 课程第三周讲座中,以 Grok Bot 为例讲解「常驻式主动智能体」的工作原理,即常驻运行、主动观察环境、自主决定何时介入的 agent。讲座分六部分,涵盖从聊天式助手到常驻 agent 的演进、模型能力变化、内部架构拆解、执行框架(工具调用、循环控制、权限与安全边界)、上下文工程以及范式前瞻。

  27. meng shao(@shao__meng)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    最新发布的 4 个 Grok Bot 模板:覆盖产品发布、安全威胁猎捕、威胁情报与 X API 开发

    SpaceXAI 团队 @pjvann 发布 4 个可直接使用的 Grok Bot 模板,覆盖产品发布(LaunchBot)、安全威胁猎捕(Threat Hunter)、威胁情报(Threat Intelligence Lead)和 X API 开发(X API Engineer)四个场景。

  28. 小互(@imxiaohu)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Code Projects 4分钟入门指南

    Claude Code Projects 向所有 Pro 和 Max 用户开放,小互给出 4 分钟入门指南:创建项目并填入目标和相关代码仓库,Claude 会把大目标拆成多个任务,每项任务建立独立线程并行执行,线程默认在云端运行,合上电脑也能继续,需要本地文件或工具时可改到电脑上运行。作者提示并行任务会更快消耗套餐额度,可以规定它如何工作、多久汇报、是否先给计划,线程之间共享项目记忆。

  29. Guillermo Rauch(@rauchg)AI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel 流量报告:58.18% 来自机器人,60%+ 部署为智能体

    Vercel 全网过去 30 天 58.18% 的流量来自机器人,2024 年 1 月这一比例为 32%。平台上 60%+ 的部署已是智能体驱动,较 2026 年 1 月的约 3% 大幅上升;Vercel 自家文档站点高达 83% 的页面浏览来自智能体,且内容越为其优化该比例越高。

  30. 技术前沿AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    我的个人 AI 智能体把银行信息发到了公司 Slack 上

    Shane Mac 的个人 AI 智能体将他的银行信息误发到了公司 Slack 上,这让他重新思考自己该如何使用这类工具。他在 10 月 9 日的讲述中提到了这一经历。

  31. AI Will(@FinanceYF5)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Supabase 每周新增 100 万数据库,Claude Code 与 Codex 带动增长

    Supabase CEO kiwicopple 称平台每周新增超 100 万个数据库,其博客称 1 月以来增长主要来自 Claude Code 和 Codex 等工具。Vercel CEO rauchg 则表示 Vercel 用 10 年达到 10 亿次部署,随后 10 个月又增加 14 亿次,其博客称目前超过一半部署由编码智能体发起。

  32. AI Will(@FinanceYF5)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LoRA 共同创作者 Edward Hu 加入 Mercor,其首个模型基于阿里 Qwen

    LoRA 共同创作者 Edward Hu 加入 Mercor 训练模型,其首个模型基于阿里 Qwen 构建。一项 2023 年研究发现,三分之一甚至更多的众包工作者用 AI 撰写「人类」答案。下一个数据来源可能是佩戴头部摄像头的工厂工人。

  33. 小互(@imxiaohu)AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok bot 支持认领专属邮箱:可注册服务、收验证码和订阅简报

    Grok bot 现在支持用户发送"认领邮箱"来获得专属邮箱地址,bot 会根据对你的了解给出几个邮箱选择。该邮箱可用于注册服务、收验证码和收据、订阅简报或报告并让 bot 帮忙总结,还能代替用户联系商家或预约时间,无需再用自己的邮箱订阅各类服务。

  34. TechcrunchAI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 切断内部评测的实时互联网访问

    Anthropic 表示,在进一步通知前,已对全部内部评测关闭实时互联网访问。此前该公司难以可靠控制其 AI 智能体。

  35. 投资融资AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus 完成 5 亿美元 C 轮融资,红杉中国、腾讯、真格等联合投资,投后估值 40 亿美元

    Manus 完成 5 亿美元 C 轮融资,由红杉中国、IDG资本、真格基金、腾讯投资、博裕资本等联合投资,投后估值达 40 亿美元。Manus 为通用 AI Agent 研发商,旗下产品包括通用 AI 代理 manus、多 Agent 群聊应用 Cue 和 AI 助手 Monica。同一批融资中,三迭纪获强生独家战略投资,DiffuSpace 与厘清智能均完成数亿元人民币天使轮。

  36. 投资融资AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Instinct 能否在 Muse 与 Dots 夹击下守住 AI 智能体热度

    曾以邀请制、无营销、无官网的极简方式走红的 AI 智能体 Instinct,在 OpenAI 的 Dots 和 Meta 的 Muse 相继推出后仍获投资人看好,9 月底估值达 100 亿美元。

  37. seangoedecke.comAI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    软件工程的“半人马时代”或将持续数十年

    人类工程师与 AI 编程系统配合的效率已超过纯人类或纯 AI 单独作业,且这一“半人马时代”可能像国际象棋那样持续约二十年甚至更久。

  38. 宝玉(@dotey)AI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 的 Claude Managed Agents 开放动态工作流公测

    Anthropic 的 Claude Managed Agents 开放动态工作流公测,主智能体先写计划,再把任务分阶段派给大批智能体并行执行,最后汇总结果,单次运行最多可调度 1000 个智能体。

    为什么值得看

    内容给出上限、测试对比和计费注意事项,便于判断这类编排方式适合哪些任务。

  39. 宝玉(@dotey)AI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Code Projects 向候补名单上的 Pro 和 Max 用户全部开放

    Anthropic 把 Claude Code Projects 候补名单上的 Pro 和 Max 用户全部放进来,功能目前为公开测试版并仍在分批推送,Team 和 Enterprise 计划暂不可用。

  40. 爱范儿AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    早报|苹果被曝削减 iPhone 18 Pro 订单,供应链称总量变化不大;小米 17 Ultra 全系涨价 1000 元、华为 nova 16 系列同日调价

    据《日经亚洲》报道,苹果要求部分供应商将 iPhone 18 Pro 和 Pro Max 零部件订单较最初要求减少至少 15%,供应链人士称降幅约 15% 至 20%,但另有供应链人士称 Pro 订单被调整至 Pro Max,整体总量没有减少。