Browser Use 今年成本降低 100 倍,比抓取 API 还便宜
Browser Use 今年成本降低 100 倍,官方称其价格已低于抓取 API 的费用。该说法来自 Gregor Zunic 的推文,由 Browser Use 官方账号转发。
Browser Use 今年成本降低 100 倍,官方称其价格已低于抓取 API 的费用。该说法来自 Gregor Zunic 的推文,由 Browser Use 官方账号转发。
个人 Agent 赛道半年内迅速升温:Instinct 9 月融资 10 亿美元、估值 100 亿美元,Meta 靠 Muse 带动股价,xAI、OpenAI、Manus 分别推出 Grok Bot、Dot、Cue。作者复盘了这半年做个人 Agent 的探索与踩坑心得。
苹果发布会正逐渐失去“科技春晚”的光环:供应链爆料让新品提前曝光,2020 年后转为提前录制,智能手机进入成熟期后创新更多体现为性能与体验优化。与此同时注意力转向 AI 发布会,2024 年 5 月 OpenAI 发布 GPT-4o、DeepSeek R1 发布都引发大范围讨论。
Stripe 联合创始人 John Collison 在 Sourcery 播客访谈中判断,AI agent 将重写商业与互联网,因为 computer use 是"通往真实世界的终极向后兼容层",AI 无需等 DMV 等机构改造网站就能直接操作现有界面办事。
决策模型 Jev 开发商 TypeSafe AI 完成约 8.7 亿美元融资,由 a16z 领投,估值达 75 亿美元,团队仅 20 人,平台日均处理 token 达数万亿级别。
「豆包工作」独立电脑版将资料研究、浏览器与电脑操作、表格整理和 PPT 制作放进同一任务入口,可在本地电脑或云端执行。实测一份两人六天五晚的北京行程方案中,它通过「浏览器录制与回放」Skill 复用查询方法,并行调用多个 Agent 研究行前准备、景点与展览信息,最终生成 20 页 PPT,预算页给出两人估算约 6310 元(不含往返北京大交通)。目前下载电脑端可限时免费领取 30 天订阅权益。
LangChain 作者 Harrison Chase 分享 @ch3nweiii 的观点:agent 中大量步骤是 yes/no 判断而非生成,不应交给每月 $20-$200 的前沿模型。
LangChain 的 Open SWE 把模型选择移入 harness,每个任务交给仍能完成工作的最便宜模型,并按质量进行测试,单任务中位成本下降 64%。开发者反馈 DeepSeek v4.1 Flash 作为编排器表现突出,可协调编码、测试、研究和子智能体,并在验证环节低成本复查代码改动,仅在更难的长尾场景才动用 Opus 或 Sol。
Claude 一次上线两项新能力:Claude Dashboards 可以把数据变成实时更新的仪表盘,Claude Motion 可以把想法变成动画解说视频,两项功能现已进入 Beta。
Claude Dashboards 面向付费套餐开启 Beta。用户只需连接数据平台或 CRM,再用自然语言提问,Claude 会自动编写查询并生成仪表盘;数据变化后内容同步更新,每张图表还会展示背后的查询语句。
Claude Docs、Slides 和 Design 正式结束 Beta,向包括 Free 在内的所有套餐开放。团队成员与 Claude 现在可以共同编辑同一份文档、演示文稿或设计。
《纽约时报》报道称,Anthropic 在周五的一篇博客文章中说明了其 AI 智能体的活动情况,但未点名被针对的网站。两名知情人士表示,Anthropic 的 AI 智能体通过美国国务院网站上的表单提交了 20 份签证申请,这些申请均不完整,未被受理。
Claude 可被用于产品经理场景:只需向它提问"上周谁使用这个功能最多?整理一份使用量最高的前 10 名报告,然后联系他们,安排 15 分钟交流",即可自动找出产品重度用户并直接约访,这可能是获取真实用户反馈最快的方法。
一位产品经理分享 Claude 的用法:让 Claude 查出上周使用量最高的用户,生成用量 Top 10 的 artifact,再主动联系这些人并安排 15 分钟交流。她称这是获取用户反馈最快的方式。
Grok Bot 现已能自主搜索、阅读并持续监控 X,覆盖行业动态、品牌口碑、投诉预警以及竞品发布、趋势和爆款内容追踪。它 24 小时运行,每天早上自动生成简报,且已包含在现有付费套餐中,被称作最便宜的 X 研究分析师。
OpenRouter 为内部 5 人销售团队打造的 AI 销售智能体 Rasp,每月节省约 600 小时工时,当前推理使用 GLM 5.2、成本约 18 美元/天。
Google Cloud 在 Gemini at Work 活动上宣布发布 Gemini,定位为面向工作的单一通用智能体,可在同一个提示框中完成问答、知识工作和写代码。
宝玉介绍了一个用 Claude Dashboard 分析 X 账号数据的用法:从 X 账号数据页下载各 Tab 数据,作为附件上传到 claude.ai/artifacts 新建的 Dashboard,交给 Claude Dashboard 分析。参考提示词为「帮我分析一下我的推文数据,看看哪些推文更受欢迎,怎么优化」。
以修改 UI 为主的功能不必先写技术方案,可以直接从改原型开始;原型改好后用 Agent 内置浏览器的“标记”工具在要改的地方标注并写评论。原型完成后,可在同一会话里让它把原型修改同步到正式代码中。作者通常用 Fable 做设计、Opus 执行、再由 Fable 验收。
小互表示可以确定 Grok Bot 现在由 Opus 5.5 驱动,让 Grok Bot 学习 Claude Motion 与 Dashboards 指南后一击命中生成视频,并上传自己的形象完成配音。该指南涵盖 Claude Dashboards 实战与避坑、Claude Motion 核心工作流、视频提示词写法、官方单车案例 81 秒演示逻辑及新手交付前检查清单。
Eazo 是一款以 App 为中心的 Personal Agent,支持用自然语言开发 App 和小游戏,并带登录、调用 AI 以及接入 Stripe 全球收款。
Mole 正在开发 AI 清理与维护功能,覆盖主流 AICoding 工具和 CLI,可处理旧版本、worktree、老对话、不在用的工具及过期内容。目前对话清理默认检查「120 天之前」,也可选择「永不清理」,Mole 就哪种默认策略更好向用户征求意见。
LangChain 推出 Managed Deep Agents 0.8,新增用户自有凭证、用户级记忆、HTTP channels、Slack 文件传输,以及由 Parallel 驱动的联网搜索预置工具。
LangChain 发布 LangSmith Fine-Tuning 和 smithtune,这是一个把 LangSmith 轨迹转成 Agent 专用微调模型的 CLI,覆盖数据集构建、基于 Fireworks 或 Baseten 的训练以及 LangSmith 评估。
Devin 推出按需云环境,支持 macOS、Linux、Windows 和 Android,让硬件不再决定开发者能在哪里、构建什么。有用户表示自己用的是 Windows PC,也能借此无缝为 iOS 构建应用。
Lee Robinson 在斯坦福 CS146S 课程第三周讲座中,以 Grok Bot 为例讲解「常驻式主动智能体」的工作原理,即常驻运行、主动观察环境、自主决定何时介入的 agent。讲座分六部分,涵盖从聊天式助手到常驻 agent 的演进、模型能力变化、内部架构拆解、执行框架(工具调用、循环控制、权限与安全边界)、上下文工程以及范式前瞻。
SpaceXAI 团队 @pjvann 发布 4 个可直接使用的 Grok Bot 模板,覆盖产品发布(LaunchBot)、安全威胁猎捕(Threat Hunter)、威胁情报(Threat Intelligence Lead)和 X API 开发(X API Engineer)四个场景。
Claude Code Projects 向所有 Pro 和 Max 用户开放,小互给出 4 分钟入门指南:创建项目并填入目标和相关代码仓库,Claude 会把大目标拆成多个任务,每项任务建立独立线程并行执行,线程默认在云端运行,合上电脑也能继续,需要本地文件或工具时可改到电脑上运行。作者提示并行任务会更快消耗套餐额度,可以规定它如何工作、多久汇报、是否先给计划,线程之间共享项目记忆。
Vercel 全网过去 30 天 58.18% 的流量来自机器人,2024 年 1 月这一比例为 32%。平台上 60%+ 的部署已是智能体驱动,较 2026 年 1 月的约 3% 大幅上升;Vercel 自家文档站点高达 83% 的页面浏览来自智能体,且内容越为其优化该比例越高。
Shane Mac 的个人 AI 智能体将他的银行信息误发到了公司 Slack 上,这让他重新思考自己该如何使用这类工具。他在 10 月 9 日的讲述中提到了这一经历。
Supabase CEO kiwicopple 称平台每周新增超 100 万个数据库,其博客称 1 月以来增长主要来自 Claude Code 和 Codex 等工具。Vercel CEO rauchg 则表示 Vercel 用 10 年达到 10 亿次部署,随后 10 个月又增加 14 亿次,其博客称目前超过一半部署由编码智能体发起。
LoRA 共同创作者 Edward Hu 加入 Mercor 训练模型,其首个模型基于阿里 Qwen 构建。一项 2023 年研究发现,三分之一甚至更多的众包工作者用 AI 撰写「人类」答案。下一个数据来源可能是佩戴头部摄像头的工厂工人。
Grok bot 现在支持用户发送"认领邮箱"来获得专属邮箱地址,bot 会根据对你的了解给出几个邮箱选择。该邮箱可用于注册服务、收验证码和收据、订阅简报或报告并让 bot 帮忙总结,还能代替用户联系商家或预约时间,无需再用自己的邮箱订阅各类服务。
Anthropic 表示,在进一步通知前,已对全部内部评测关闭实时互联网访问。此前该公司难以可靠控制其 AI 智能体。
Manus 完成 5 亿美元 C 轮融资,由红杉中国、IDG资本、真格基金、腾讯投资、博裕资本等联合投资,投后估值达 40 亿美元。Manus 为通用 AI Agent 研发商,旗下产品包括通用 AI 代理 manus、多 Agent 群聊应用 Cue 和 AI 助手 Monica。同一批融资中,三迭纪获强生独家战略投资,DiffuSpace 与厘清智能均完成数亿元人民币天使轮。
曾以邀请制、无营销、无官网的极简方式走红的 AI 智能体 Instinct,在 OpenAI 的 Dots 和 Meta 的 Muse 相继推出后仍获投资人看好,9 月底估值达 100 亿美元。
人类工程师与 AI 编程系统配合的效率已超过纯人类或纯 AI 单独作业,且这一“半人马时代”可能像国际象棋那样持续约二十年甚至更久。
Anthropic 的 Claude Managed Agents 开放动态工作流公测,主智能体先写计划,再把任务分阶段派给大批智能体并行执行,最后汇总结果,单次运行最多可调度 1000 个智能体。
内容给出上限、测试对比和计费注意事项,便于判断这类编排方式适合哪些任务。
Anthropic 把 Claude Code Projects 候补名单上的 Pro 和 Max 用户全部放进来,功能目前为公开测试版并仍在分批推送,Team 和 Enterprise 计划暂不可用。
据《日经亚洲》报道,苹果要求部分供应商将 iPhone 18 Pro 和 Pro Max 零部件订单较最初要求减少至少 15%,供应链人士称降幅约 15% 至 20%,但另有供应链人士称 Pro 订单被调整至 Pro Max,整体总量没有减少。