跳到正文

#Agent

今日 0 条
9月22日周二
  1. Andrew Ng(@AndrewYNg)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    吴恩达:AI 风险被炒作夸大,近两周恐慌是公关推动

    吴恩达称近两周针对 AI 危险的恐慌由一场组织化的公关活动推动,AI 技术并未出现意外危险转向,人类灭绝风险与几个月前相比没有上升。他认为变化最大的是 AI 的网络攻击能力,值得认真对待但不会导致世界末日;OpenAI 一个团队曾部署智能体集群入侵 Hugging Face,有报道称规模达 1200 个智能体,而 OpenAI 有缺陷的沙箱与监控流程是事件关键成因。

  2. Browser Use(@browser_use)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok 4.7 发布,Long Horizon Browser Use Benchmark v2 得分 39.9 仍落后 DeepSeek

    Grok 4.7 发布,在 Long Horizon Browser Use Benchmark v2 上得分 39.9,高于 Grok 4.6 的 31.2,但仍不及 DeepSeek V4.1 Flash 的 47.9 和 GPT-6 Astra 的 80.6。其得分不到 Astra 的一半。

  3. Google Gemini App(@GeminiApp)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gemini 购物功能直播演示:9 月 22 日 11am PT

    Google Gemini App 将于 9 月 22 日 11am PT 举办直播演示,展示如何用 Gemini 购物,包括辅助决策购买、对比选项,以及通过拍照浏览商品。直播在 Discord 观看,地址为 discord.gg/gemini。

  4. Guillermo Rauch(@rauchg)AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nat Friedman:muse 从零构建,产品上深受 openclaw 启发

    Nat Friedman 表示 muse 是从零构建的,但产品上深受 openclaw 启发。他在 1 月使用 openclaw 后为 MSL 团队购入数百台 Mac mini,团队许多人爱上了 openclaw 及其他个人智能体,他认为 @steipete 的 harness 从一开始就具有开创性。muse 的目标是打造类似 openclaw 但安全、易用、可扩展至数十亿人的产品。

  5. Amjad Masad(@amasad)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 正在重振美国梦:Jon Cheney 用 Replit 花 $400 打造 GenAIPI,18 个月估值 $20M

    Jon Cheney 在 Replit 上仅花 $400 就搭建出 GenAIPI,5 天内靠首位客户赚到 $15k,6 周收入达 $180k,18 个月后该项目估值 $20M。Amjad Masad 以此为例称 AI 正在重振美国梦。

  6. Lovable(@lovable_dev)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jev 上线 Lovable AI Gateway,9/27 前免费试用

    Jev 现已接入 Lovable AI Gateway,即日起至 9/27 23:59 UTC 可免费用它构建 AI 功能。Alexandre Pesant 同时发布 Jev completions API 与 Jev Playground,称可用其替换现有 LLM 做文本生成。

  7. Aadit Sheth(@aaditsh)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta 的 Muse 被亚马逊切断:互联网即将上演机器人持饼干互砍的混战

    亚马逊切断了对 Meta 旗下 Muse 的接入。在作者看来,各方都不愿在这一局里被商品化或沦为被叠加的一层,一场数字领域的"持饼干机器人互砍"混战即将开始。

  8. Google AI Developers(@googleaidevs)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Gemini 3.8 Live Extended Thinking 打造能"看屏幕"的编程辅导工具

    Google 用 Gemini 3.8 Live Extended Thinking 构建了一个编程辅导工具,能识别用户屏幕上的 bug 并通过 function calling 引用 p5.js 库,然后讲解其中的逻辑。该演示展示了模型实时看屏加函数调用的组合用法。

  9. Cognition(@cognition_labs)AI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Devin 推出 devin ssh,可远程接入其开发环境

    Cognition 为 Devin 推出 devin ssh,可远程接入 Devin 的开发者环境并当作自己的环境使用。用户能直接浏览和编辑代码、启动 dev server 并转发端口测试 Devin 的工作,也可通过 scp 从虚拟机取回文件,完成后用 CLI 的 /handoff 把工作交回本机。

  10. Cognition(@cognition_labs)AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 推出 Devin Cloud 终端入口与 devin ssh

    Cognition 为 Devin 的云端计算机推出两种新用法:在 CLI 中通过 /cloud 创建、引导和恢复 Devin Cloud 会话,以及首次支持通过 SSH 登录 Devin 的专属 VM,再用 /handoff 把工作交回自己的设备。

  11. GitHub(@github)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GitHub 一名工程师与智能体团队将 Copilot agent runtime 移植到 Rust

    GitHub 表示,仅由一名工程师和一个智能体团队,就把 GitHub Copilot agent runtime 移植到 Rust,交付 80 万行生产代码并保持了代码质量。官方在推文中附上 github.blog 的说明链接,介绍其具体做法。

  12. HeyGen(@HeyGen_Official)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    HyperFrames 与 Google DeepMind、Kaggle 联合推出 Code2Video Bench,衡量代码生成视频质量

    HyperFrames 联合 Google DeepMind 和 Kaggle 推出 Code2Video Bench,用于衡量模型生成的代码能否渲染成值得观看的视频。该基准指出,SWE-bench 意义上的代码能力与"代码转视频"是两回事,目标是让前沿实验室在智能体视频任务上取得进展。

  13. eric zakariasson(@ericzakariasson)AI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    xAI 发布 Grok 4.7 模型卡:Terminal-Bench 从 20.3% 升至 38.0%

    xAI 公布 Grok 4.7 模型卡,多项基准较 4.6 明显提升:Terminal-Bench 从 20.3% 升至 38.0%,SWE-Marathon 从 31.9% 升至 46.0%,HealthBench Pro 从 48.5% 升至 56.7%,Legal Agent 从 15.8% 升至 19.6%,EEBench 从 60.0% 升至 66.0%。价格与 4.6 相同。

  14. ChatGPT(@ChatGPTapp)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 接入信用分后可解答租房、还卡与车贷房贷问题

    ChatGPT 接入信用分后,可帮用户判断信用如何影响租房申请、比较不同信用卡的还款取舍、探索长期建立信用的方式,并查看信用与预算如何影响汽车租赁和房贷选项。

  15. Harrison Chase(@hwchase17)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Harrison Chase:为什么我看好决策模型——智能体系统只是围绕模型的良好工程

    Harrison Chase 表示,他看好决策模型的原因是智能体系统本质上只是围绕模型做良好工程,而非追求"全能模型"。他认为"build prod, not god",这类快速、便宜且准确的模型对此非常关键,围绕 jev 的热度也说明多数人持同样看法。

  16. LlamaIndex 🦙(@llama_index)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex 为 Extract 加入 Grounded Confidence 置信度分数

    LlamaIndex 为 LlamaParse Extract 引入 Grounded Confidence,可按字段给出置信度分数,帮助判断抽取数据的准确度。应用可据此决定哪些结果自动采纳、哪些转人工审核。该功能已在 Cost Effective、Agentic 和 Agentic Plus 三个档位上线。

  17. DeepLearning.AI(@DeepLearningAI)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta 的 Muse 智能体在操作系统层防御提示词注入

    DeepLearning.AI 分享了对 Meta 的 Muse 智能体的分析,指出提示词注入防御不应只依赖模型自身训练。该智能体假设模型会被骗,转而在操作系统层构建安全:模型不接触真实凭证,工具运行在隔离的 Linux 容器中,并由独立守门程序校验外发调用。

9月21日周一
  1. Harrison Chase(@hwchase17)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangSmith Gateway 限时免费提供开源决策模型 SemIf(基于 Qwen3.5)

    LangSmith Gateway 将开源决策模型 SemIf 免费开放一周,该模型基于 Qwen3.5。SemIf 属于新型的 decision models(决策模型),兼容 TypeSafe SDK,只需改动一个字符串即可试用。

  2. Browser Use(@browser_use)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Browser Use 向 20 人送出 50 美元额度与 iOS TestFlight 早期访问

    Browser Use 向 20 名转发分享需求的用户各提供 50 美元供其智能体消费,并给予 iOS TestFlight 早期访问资格。活动由 Johannes Dittrich 发起,参与者需转发并说明希望 Browser Use 应用具备哪些功能。

  3. LangChain BlogAI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 实测 TypeSafe AI 的 Jev 能否成为更好的 Agent 评估器

    LangChain 用 Deep Agents 构建天气 agent,在 LangSmith 数据集上对比 TypeSafe AI 的 Jev 与 GPT-5.6 Luna、GPT-5.6 Terra、Claude Sonnet 4.6 三种 LLM 评委。

  4. Runway(@runwayml)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Runway 9 月 30 日旧金山线下黑客松:用 Runway API 构建智能体、应用或创意工作流

    Runway 将于 9 月 30 日在旧金山 Masonic 举办为期一天的线下黑客松,与 Runway AI Summit 同场,参赛者需用 Runway API 构建智能体、应用或创意工作流。活动不设路演和审批流程,下午 5 点前提交可运行 demo,即有机会赢取 25K 美元和 200K credits。

  5. 阿里技术AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里巴巴集团 AI Native 研发实践论坛倒计时 2 天,将发布《AI Native 研发范式实践手册》

    阿里巴巴集团 AI Native 研发实践论坛将于 9 月 23 日云栖大会 Day2 14:00-16:25 在杭州国际博览中心一期三楼 301 举办,现场将发布《AI Native 研发范式实践手册》。论坛聚焦 AI 原生时代的技术变革与工程实践,展示阿里巴巴集团从 AI 基础设施到业务场景的全景实践,并邀请复旦大学、蚂蚁集团代表共同探讨研发范式演进方向。

  6. 真格基金AI 评估 · 14/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    一小时,刘元和 ChatGPT 聊了什么?

    真格基金让 ChatGPT 当主播,与投资人刘元进行了一场无预设的一小时对话。刘元谈到 AI 之后 VC 是否会消失、早期投资依赖的乐观与非理性,以及 ChatGPT 自认做不好投资决策、没有恐惧因而也没有勇气。他给年轻人的建议是:当 AI 什么都做得更好,要有勇气去追逐自己想做的事。

  7. 随机小分队AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    YC S26“硬核”盘点:234 家初创公司里,Agent 正在进入工厂、药房和仓储

    YC S26 批次共选出 234 家公司,Agent 工具与企业工作流是最密集方向,机器人、算力、医疗、国防等重投入领域也频繁出现。家务机器人 Nori 定价 1,688 美元,可叠衣服、打扫房间并通过训练学习新任务;Context.dev 把网页整理成 Agent 可调用的格式,Screenpipe 记录电脑操作作为可搜索记忆。

  8. 随机小分队AI 评估 · 5/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Linkloud 先锋加速营第16期招募:寻找2028年的Agent机会,10月走进硅谷

    Linkloud 先锋加速营第16期开启招募,行程定于10月12日至16日在旧金山及硅谷,主题为"寻找2028年的Agent机会",包含超过20场闭门分享会。招募面向对全球化与AI感兴趣的创业者、从业者及投资人,覆盖Agent Native公司高管、AI Lab研究员、硅谷VC及人财税法、数据合规等资源对接。

  9. 快手技术AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    快手技术沙龙第五期回顾:聚焦 Data Agent,共探数据生产与智能决策新范式

    快手在第五期技术沙龙上首次系统披露 Data Agent 规模化落地数据:平台 WAU 突破 10,600,周人均对话 55 次,数据分析师与产品运营渗透率超 80%,NPS 达 73.5,单次任务提效中位数 13 倍。

  10. 魔搭ModelScope社区AI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Convai Innovations 开源 421M 参数决策模型 Laya,33 毫秒完成 System 1 决策

    Convai Innovations 开源了非自回归 System 1 决策模型 Laya,含 421M 参数,基于 ModernBERT-large 主干和 RLCD 训练概率输出,GPU 推理延迟 33~38 毫秒,采用 Apache 2.0 协议,可在本地部署。

  11. 机器之心SOTA模型AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阶跃星辰发布 Step 5 Preview,千问开源 Qwen-Image-2.1,TypeSafe AI 开放 Jev

    阶跃星辰发布 Step 5 Preview,采用稀疏 MoE 架构,总参数 600B、每 Token 激活 27B,支持 100 万 Token 上下文与视觉输入,已通过阶跃产品与 API 提供,完整权重计划于 10 月 15 日发布。

  12. 阿里云开发者AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    2026 云栖大会技术主论坛 MaaS & Agent:千问办公、Qoder、千问 APP 发布新版本

    2026 云栖大会技术主论坛 MaaS & Agent 于 9 月 22 日 13:30 在杭州国际博览中心二期 3 楼主会场举行,主线为「创造 Token、成就 Agent、交付生产力」。

  13. LovartAI(@lovart_ai)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovart 提示词玩法:让 AI Agent 填满容器两面的自我认知测试

    Lovart 上流传一个提示词玩法:把图片交给 AI Agent 并问它"根据你知道的关于我的一切,把这个容器两面都填满",会得到很有意思的结果。该玩法由 Penny777 分享,原句为"Lovart, tell me everything you know about me and fill both sides of this container."

  14. 小米技术AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从开源出发,让 AI 走进日常生活:小米 AI 硬创团队的四个探索

    小米 AI 硬创团队开源了四件 AI 硬件探索作品:AI 记忆配饰 DayoTag 采用无服务端本地记录并支持扩展 Skill;哈基米 PetAgent 把 Agent 运行状态同步到桌面摆件。

  15. 卡尔的AI沃茨AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    实测阶跃星辰 Step 5 Preview:网页复刻追平第一梯队,价格只要三分之一

    阶跃星辰新模型 Step 5 Preview 实测显示前端 UI 复刻能力已追上第一梯队,排名较上个版本提升 13 名,与 K3 和 Grok 打平,价格仅为 K3 的三分之一。用一句话提示词即可复刻 Apple 官网首页,接入 Claude 框架后能从 72 页 PDF 中逐条提取数字、审计含 14 张工作表 1800 多条公式的 Excel 模型并揪出 22 个单元格错误。

  16. 月之暗面 KimiAI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Kimi Code Desktop 发布,macOS 与 Windows 同步上线

    Kimi Code Desktop 正式发布,macOS 和 Windows 版同步上线,可通过 kimi.com/code 安装使用。它把 Kimi Code 的 AI Agent 能力搬进桌面应用,支持对话读写代码、运行命令和自动化任务,并提供内置终端、内置浏览器、Git 状态查看与按文件审阅改动。

  17. 甲子光年AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    客服智能体走到“上岗”前夜,企业还要跨过几道门槛?|iRTE2026 企业级客服智能体专场

    iRTE2026 实时智能大会将于 10 月 23 日至 24 日在北京悠唐皇冠假日酒店举行,并设置“企业级客服智能体专场”,邀请声网、冠客科技、美团、阿里、MiniMax 等企业探讨客服智能体从“能对话”迈向“能办事、能转化、能增长”。

  18. 大淘宝技术AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    大淘宝技术:Loop engineering 如何把 agent 放进工程循环

    大淘宝技术会员技术团队提出 Loop engineering 理念,工程师不再逐轮提示 agent,而是设计包含读取状态、判断任务、执行、验证、记录状态和判断停止条件的自动化循环。

  19. 稀土掘金技术社区AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    稀土掘金×火山引擎 AI 用量周榜冲刺赛:冲榜赢 200 元代金券

    稀土掘金联合火山引擎推出 AI 用量周榜冲刺赛,活动时间为 2026 年 9 月 21 日至 10 月 4 日,分两期统计用户使用 Cursor、Claude、Codex 等 AI 编程工具产生的 Token 用量排名。

  20. Yangyi(@Yangyixxxx)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    带手机端的 Agent 客户端 GrokBot、NewMax、Cindy、Workbuddy:电脑开机即可持续干活

    GrokBot、NewMax、Cindy、Workbuddy 等带手机端的 Agent 客户端,可在电脑保持开机时远程持续执行任务。另有作者预告本周计划开源一个 Obsidian Agent 插件,以及一套一句话部署网站的系统,支持 Vercel、Cloudflare,复制 Prompt 即可使用。

  21. 阿里研究院AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    安筱鹏:AI时代,数据如何构筑企业的护城河

    阿里云智能副总裁安筱鹏在中国国际大数据产业博览会上提出,AI时代企业护城河取决于数据从比特到Token的转化率,而非数据存量或模型强弱。他引用a16z报告称,今年2月AI智能体的Token消耗首次超过人类用户,到8月已达人类用户的5倍,前沿企业与一般企业的Token消耗差距从2.6倍扩大到8.3倍。企业需构建数据知识资产化、模型管理、智能体开发运营三大平台,以及智能体运营与模型训练两个飞轮。

  22. 硅谷科技评论AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    红杉如何让一个人对抗投委会:哪怕只得 1 分也能投

    红杉伦敦合伙人 Julien Bek 在 20VC 披露,红杉项目按 1 到 10 分打分,即便有人投 1 分,发起人仍可按下绿灯;Shaun Maguire 带 SpaceX 进来时正有人投 1 分,他逼所有合伙人飞过去亲眼看,先投小额再引出一笔重仓,如今位居该基金史上回报最前列。

  23. 沃垠AIAI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    实测阶跃星辰 Step 5 Preview:五项任务表现如何

    作者冷逸把阶跃星辰 Step 5 Preview 的 API 接入 WorkBuddy 实测,覆盖前端网页、塔防游戏、3D 互动游戏、跨平台适配和运营报告 PPT 五类任务,其中塔防游戏一次性生成且可通关,3D 游玩与关卡设计离 GPT-6 仍有差距。