跳到正文

#OpenAI

今日 79 条
9月6日周日
  1. Browser Use(@browser_use)AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Astra 在 Browser Use Benchmark v2 上以 77.3% 大幅领先 Opus 5 与 GPT-5.6

    Astra 在 Browser Use Benchmark v2 上取得 77.3%,远高于 Opus 5 的 50.5% 和 GPT-5.6 Sol xhigh 的 49.1%,在 60 项任务中有 22 项满分,而 Opus 5 无一满分。该消息由 Gregor Zunic 发布,并提到 fable 拒绝的任务过多。

  2. AI产品黄叔(@PMbackttfuture)AI 评估 · 14/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT 6 Astra 发布后的人类幼崽😱

    GPT 6 Astra 发布后,社交平台上出现了一条以"人类幼崽"为题的视频内容,该帖获 254 条回复、74 次转发、838 次点赞和 180337 次浏览。原文未披露 GPT 6 Astra 的具体功能、参数或可用性信息。

  3. AI产品黄叔(@PMbackttfuture)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT 6 Astra 之后 Codex 生图更精致,或因 Astra 能力更强

    有用户发现 GPT 6 Astra 上线后,Codex 里的生图效果明显更加精致,一度以为 GPT image 2.5 已经推出。经搜索后其判断,这一变化估计仍是 Astra 本身能力更强所致。

  4. Sam Altman(@sama)AI 评估 · 0/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sam Altman 回应 @Royultea_:他们给了我一个特别的

    Sam Altman 在 X 上回复 @Royultea_ 称"他们给了我一个特别的",未说明所指对象或具体内容。该回复获得 7380 次点赞、577492 次浏览。

9月5日周六
  1. Sam Altman(@sama)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sam Altman:Astra 能把我随口想到的小游戏几分钟内做出来

    Sam Altman 表示,Astra 能把他想象出的任何小游戏做出来,几分钟后他就能上手玩,他认为这很酷。他同时称,相对于其他一切,这件事显然微不足道。

  2. 阿真IreneAI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用GPT-6 Astra做了个有意思的尝试

    作者花了一个下午用GPT-6 Astra完成了一次趣味尝试,但未透露具体做法与结果。

  3. Greg Brockman(@gdb)AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Greg Isenberg 分享 9 个值得一试的 GPT 6 Astra 提示词

    Greg Isenberg 列出 9 个值得尝试的 GPT 6 Astra 提示词,涵盖账单砍价、把代理服务逆向工程为 AI 产品、二手市场捡漏、一人公司仪表盘、企业智能体机会审计、浏览器操作员和自动化 QA 等场景。其中"代理变软件"提示词要求拆解某细分服务业务的工作流,并设计可收费 $500-$5,000/月的最简 AI 产品。

  4. 向阳乔木推荐看AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从 X 跳槽 OpenAI 的赵迪:马斯克是"最大的混蛋"但依然敬佩

    在 X 工作近 7 年的 ML Infra 工程师赵迪已加入 OpenAI,他称马斯克是"the biggest asshole"但仍然敬佩,认为马斯克裁员、按第一性原理做事能让人做到不可能的事。他自研的 Rust 推理引擎 Navi 曾将 X 推理性能提升一个数量级,为平台省下几百万美元。他还表示 OpenAI 内部 Codex 使用量年初至今增长 8 到 10 倍,亚太地区涨幅达 12 倍。

  5. Genspark(@genspark_ai)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Genspark 在 Code agent 与 Claw 中接入 GPT-6 Astra

    Genspark 宣布 GPT-6 Astra 已接入其 Code agent 和 Claw。所引 OpenAI 内容称,用户在电脑上能做的事 Astra 都能代为完成,主打速度。Genspark 称该模型为工作场景打造,并附上 genspark.ai 试用入口。

  6. AI产品黄叔(@PMbackttfuture)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT 6 前端生成能力实测:孩子几轮对话做出「咪咪小镇」

    有用户用 GPT 6 给孩子做「咪咪小镇」项目,给出参考后几轮对话就生成了界面,孩子被界面吸引。室内原本没有 3D 场景,孩子用一句话提出让居民能"现实进去"、每栋楼都要能看到里面,随即也生成了。该帖称 GPT 6 的前端能力比之前强多了。

  7. Augment Code(@augmentcode)AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6 Astra 上线 Cosmos,长程编码与多步智能体能力大幅提升

    OpenAI 迄今最强的模型 GPT-6 Astra 已在 Cosmos 上线,在长程编码和多步智能体任务上有显著提升。用户可通过 augmentcode.com 提交高难度任务,该模型适合在假期周末长时间运行。

  8. Perplexity(@perplexity_ai)AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6 Astra 上线 Perplexity Computer,面向 Pro 和 Max 订阅用户

    GPT-6 Astra 已在 Perplexity Computer 中上线,面向 Pro 和 Max 订阅用户开放。该消息由 Perplexity 官方账号发布,未披露更多模型能力或接入细节。

  9. Poe(@poe_platform)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT 6 Astra 上线 Poe

    Poe 宣布 GPT 6 Astra 已在其平台上线,可试用并与其他领先模型对比,入口为 poe.com/GPT-6-Astra。

  10. v0(@v0)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6 Astra 已在 v0 上线

    GPT-6 Astra 现已在 v0 上线,可通过 v0.app 试用。该消息由 v0 官方账号发布,未披露模型参数规模、上下文长度或开放方式等细节。

  11. Greg Brockman(@gdb)AI 评估 · 84/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 发布 GPT-6 Astra,先向 Pro、Enterprise 与 Business Premium 用户开放

    OpenAI 的 GPT-6 Astra 已在 Work/Codex 中向全部 Pro、Enterprise 和 Business Premium 用户开放,并同步上线 API,Plus 和 Business 用户将在之后开始逐步 rollout。

    为什么值得看

    原文给出 GPT-6 Astra 已向哪些用户开放与后续节奏,读者可据此判断自己何时能用上。

  12. Windsurf(@windsurf_ai)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6 Astra 现已登陆 Devin Desktop 与 Devin CLI

    GPT-6 Astra 已在 Devin Desktop 和 Devin CLI 上线。在 FrontierCode 1.1 上,Astra 的成绩与 Fable 5 相差 0.4 分以内,成本却低 64%,并在内部测试基准上刷新 SOTA,能生成更全面的测试、更清晰的报告和更好的视频证据。

  13. DeepLearning.AI(@DeepLearningAI)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    The Batch 本周亮点:编程智能体技能、OpenAI 与 Anthropic 企业数据留存政策、GLM-5.3-Flash 等开放权重模型

    DeepLearning.AI 的 The Batch 本周汇总多条动态:OpenAI 与 Anthropic 公布新的企业数据留存政策,Zai 发布高性价比开放权重多模态系统 GLM-5.3-Flash,Thomson Reuters 推出 397B 参数、专为法律金融新闻工作训练的模型。Andrew Ng 则解释使用编程智能体需要一套自己的基础技能。

9月4日周五
  1. Milvus(@milvusio)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6 Astra 释放信号:长时运行智能体光靠上下文压缩不够,Milvus 3.0 补上记忆检索层

    GPT-6 Astra 拥有 1.05M token 上下文窗口,在 OpenAI 的 MRCR v2 8-needle 测试中于 512K–1M 上下文下得分 96.3%,而 GPT-5.6 Sol 为 73.8%。

  2. AI SDK(@aisdk)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    在 AI SDK 中使用 GPT 6 Astra

    OpenAI 发布 GPT-6 Astra,官方描述为"凡是你能在电脑上做的事,Astra 都能替你做",主打速度。AI SDK 已提供集成支持,可通过其调用 GPT-6 Astra。

  3. Latent.Space(@latentspacepod)AI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6 发布反响首次超过 Claude,Latent.Space 称 AI 工程进入新阶段

    OpenAI 的 GPT-6 发布反响首次在一年内超过 Claude 发布,Latent.Space 称这是此前认为今年不可能出现的巨大反转。swyx 表示已跨入 AI 工程的新时代,并称这只是他与 Astra 所做工作的一部分,后续报告将陆续在 LS 发布。

  4. DeeplearningAIAI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    小红书团队提出 Self-GC,用 LLM 自主管理智能体上下文

    小红书(RedNote)的 Xubin Hao 及同事提出自主管理上下文方法 Self-GC,在把上下文发给关联 LLM 之前,由一个大语言模型决定哪些部分保留、删减或丢弃。

  5. Greg Brockman(@gdb)AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Greg Brockman 对 Astra 登陆 Azure 表示期待

    Greg Brockman 表示期待 Astra 登陆 Azure,并转述 Satya Nadella 称已有早期客户开始使用。Satya Nadella 同时分享了 Azure 官方博客中关于 Astra 的链接。

  6. Satya Nadella(@satyanadella)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    早期客户已在 Azure 上使用 Astra

    Satya Nadella 表示,已有早期客户在 Azure 上使用 Astra。推文附带的链接指向 Azure 官方博客中关于 GPT 的内容。

  7. Jim Fan(@DrJimFan)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jim Fan 回忆 OpenAI 2016 年 World of Bits:十年后 Astra 让智能体真正订上机票

    Jim Fan 回顾 OpenAI 2016 年的 World of Bits 项目,当时智能体靠看屏幕像素、移动鼠标在 United 上订机票,却因依赖手工设计的分任务奖励函数和 Pascal Titan X GPU 从头做 RL 而失败。

  8. Stanford AI Lab(@StanfordAILab)AI 评估 · 70/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6 Astra 发布:更聪明、更对齐,但存在代码冗余与确认过多问题

    Stanford AI Lab 毕业生 Yann Dubois 表示 Astra 已发布,主要变化包括更聪明、更对齐可信赖以及更好的 CUA 能力,并展示了 Astra 用 Blender 搭建的房子。他同时指出仍存在代码冗余过多、请求确认过于频繁等问题,并提醒 Astra 比 5.6 更严格遵循指令,包括旧技能中隐藏的不必要指令,建议使用前先清理。

  9. Stanford AI Lab(@StanfordAILab)AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI GPT-6 Astra 发布,Terminal-Bench-Science 成头号评测基准

    OpenAI 发布 GPT-6 Astra,其在 Terminal-Bench-Science 0.1 上的成绩从 GPT-5.6 Sol 的 22.4% 跃升至 64.6%,提升 42.2 个百分点。

  10. Greg Brockman(@gdb)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI GPT-6 Astra 在 ARC-AGI-3 取得 SOTA,该基准已被刷满

    Greg Brockman 引用 ARC Prize 消息称 ARC-AGI-3 现在已被刷满。OpenAI 的 GPT-6 Astra 在该基准上取得 SOTA:Astra 在 ARC-AGI-3 上得分 63%,通过新的 provider adapter harness 达到 99%,在 96% 的 ARC-AGI-3 关卡上超过人类表现,并构建出目前所见最精确的新环境符号模型。

  11. Latent.Space(@latentspacepod)AI 评估 · 59/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Latent.Space 实测 OpenAI Astra:耗 20B tokens 跑通 AI 工程全流程

    Latent.Space 称投入超过 20B tokens 将 OpenAI 的 Astra 用于各类 AI 工程任务实测,而非仅做 Blender 演示和游戏案例。

  12. Amjad Masad(@amasad)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6 能力大幅跃升,即将上线 Replit 供体验

    Replit 将很快上线 GPT-6,供用户试用。据 Replit CEO Amjad Masad 表示,GPT-6 在能力上有重大跃升,将解锁新的使用场景。

  13. Greg Brockman(@gdb)AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 发布 GPT-6 Astra,在 FrontierMath Tier 4 等基准达 SOTA

    OpenAI 发布 GPT-6 Astra,Greg Brockman 称其在 FrontierMath Tier 4、ARC-AGI 3 和 TerminalBench-4.0 上达到当前最优水平。

  14. Greg Brockman(@gdb)AI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 发布 GPT-6 Astra

    OpenAI 的 Greg Brockman 在 X 上发布 GPT-6 Astra,并附上官方页面链接 openai.com/index/gpt-6-as…。该推文未披露模型能力、版本细节或开放范围。

  15. ChatGPT(@ChatGPTapp)AI 评估 · 73/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 开始推送 GPT-6 Astra,面向 ChatGPT 付费用户与 API

    OpenAI 宣布 GPT-6 Astra 今日起向有限数量的组织推送,未来几天将向所有 ChatGPT Plus、Pro、Business 和 Enterprise 用户开放,同时通过 OpenAI API 和 AWS 提供。官方建议在获得访问权限后下载 ChatGPT 桌面应用以获得最佳 Astra 体验。

  16. ChatGPT(@ChatGPTapp)AI 评估 · 75/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 发布 GPT-6 Astra

    OpenAI 的 ChatGPT 账号宣布推出 GPT-6 Astra,称其为进入 Chat 的新星,原帖附带一段视频但未给出具体能力说明。

  17. ChatGPT(@ChatGPTapp)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 官方称 GPT-6 Astra 在电脑操作、浏览与智能体编码等六项能力上达到 SOTA

    ChatGPT 官方账号称 GPT-6 Astra 在六项能力上达到 state-of-the-art,分别是电脑操作、浏览、智能体编码、网络安全、科学和专业工作。该推文未给出具体的评测基准名称、分数或模型开放时间。

  18. Satya Nadella(@satyanadella)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Satya Nadella 与黄仁勋就 NVIDIA 收购 Hugging Face 表态

    NVIDIA 将收购 Hugging Face。黄仁勋称这对 NVIDIA 和 Hugging Face 是重要的一天,认为开放模型能增强安全与网络安全、加速创新与扩散并实现主权,让每个开发者、初创公司、大学、行业和国家都能构建、定制并受益于 AI。Satya Nadella 表示期待与 NVIDIA 和 Hugging Face 的生态继续合作,见证开放模型持续繁荣成长。

9月3日周四
  1. ChatGPT(@ChatGPTapp)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 预告"星辰即将对齐"

    ChatGPT 官方账号发布一句"星辰即将对齐",并附一段视频,但未在推文中说明具体所指。该帖获 25439 点赞、1776 转发、1861 回复,浏览量约 496 万。原文未透露任何模型、版本或功能信息。

  2. Aadit Sheth(@aaditsh)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    相比 Codex/Cursor/Claude Code,大家具体用 Grok @bot 做什么?

    有用户提问:相比 Codex、Cursor、Claude Code,大家具体用 Grok @bot 来做什么。该帖获得 10 条回复、18 个点赞和 17324 次浏览。

  3. Aadit Sheth(@aaditsh)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sam Altman 用"38000 次 ChatGPT 查询 = 一颗加州杏仁的用水量"做类比

    Sam Altman 称每 38000 次 ChatGPT 查询的耗水量相当于在加州生产一颗杏仁的用水量。这条类比被评价为传播范例:把关键数字提前备好,在恰当时机抛出,如同乔布斯说 iPod 是"口袋里的 1000 首歌"。

  4. 百度Geek说AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    都在开源 Harness,Codex 和 DeepSeek 到底有什么不一样?

    2026年8月,DeepSeek 开源 DeepSeek Harness 后两天冲上 9 万多 GitHub Star,OpenAI 随后开源 Codex 的 Harness 层,包括 CLI、app-server 和官方 SDK。

  5. 枫言枫语AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vol. 173 苹果换帅,Claude 5.1 发布,GLM 低价偷家,英伟达要买 Hugging Face 等

    苹果 CEO Tim Cook 卸任,John Ternus 于 9 月 1 日正式接任;Anthropic 发布 Claude 5.1,GLM-5.3-Flash 以极高性价比推出。NVIDIA 计划以 129 亿美元收购 Hugging Face,OpenAI 公测 Ultrafast 模式并宣称提升 14 倍,还联合 Broadcom 研发 LLM 推理加速芯片。