跳到正文

#OpenAI

今日 70 条
10月8日周四
  1. Feed: Artificial Intelligence LatestAI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为所有用户更新 ChatGPT,推出更视觉化的 Intelligent UI

    OpenAI 面向所有用户更新 ChatGPT,加入名为 Intelligent UI 的界面,让聊天机器人在输出中直接生成交互式元素,整体呈现更偏视觉化。该报道指出这次更新的展示成分多于实际说明。

  2. 技术前沿AI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Common Sense Media 称 OpenAI 的 ChatGPT 青少年版存在不可接受风险

    Common Sense Media 旗下 Youth AI Safety Institute 呼吁 OpenAI 限制 ChatGPT 的使用,称其面向未成年用户的护栏未达到承诺要求,构成不可接受的风险。

  3. Gary Marcus(@GaryMarcus)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gary Marcus 与 Terence Tao 点评 OpenAI 数学大动作

    Gary Marcus 与 Terence Tao 就 OpenAI 的数学领域大动作发表互补评论,试图解读数学研究的新范式。相关内容发布于 Gary Marcus 的 Substack。

  4. garymarcus.substack.comAI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gary Marcus 与 Terence Tao 评 OpenAI 新数学模型的模糊发布

    Gary Marcus 与 Terence Tao 就 OpenAI 新公布的数学成果发表互补评论。Marcus 指出,OpenAI 仅称"用同一流程、借助未发布模型"完成证明,未披露架构、失败率、训练与数据增强细节,还提到证明是否由 Lean 一次性生成并验证也不清楚。他认为无法判断该结果的通用性,甚至无法排除其只是借助 Lean 与合成数据在可验证领域取巧。

  5. NVIDIA AI(@NVIDIAAI)AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 的 SynthID Detector 面向所有人开放

    Google DeepMind 宣布 SynthID Detector 现已面向所有人开放,可检测在线内容是否由 GoogleAI 或 OpenAI、NVIDIA、Kakao 等合作方工具生成,Apple 也将加入。NVIDIA 表示其 build.nvidia.com 上由 Cosmos 生成的内容已用 SynthID 加水印,任何人都可以把这些内容上传到检测器核实来源。

  6. 核心模型与趋势AI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    a16z 两份报告:仅 4.5% 美国消费者为 AI 付费,GPU 租金不降反升

    a16z 第七版消费级 AI 应用报告显示,只有 4.5% 的美国消费者为 ChatGPT、Gemini 或 Claude 付过个人订阅费,近一半人用过 AI 但每天使用的只有四分之一。

  7. The Cloudflare BlogAI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cloudflare 打造基于证据的多 AI 智能体安全运营框架

    Cloudflare 推出内置多 AI 智能体安全运营框架 Managed Defense,先由确定性代码完成侦察、再由协调 AI 智能体并行调度流量分析、客户上下文。

  8. Gary Marcus(@GaryMarcus)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gary Marcus 质疑 OpenAI 未发布模型的证明成果:真正的新闻是没告诉我们的东西

    Gary Marcus 批评 OpenAI 一份关于未发布模型生成数学证明的报告信息严重缺失:外界不知道具体流程、模型架构、失败率以及训练、后训练和数据增强细节,也无法判断结果在数学之外的可泛化性。他认为该成果既可能是通向 AGI 的一步,也可能只是在 Lean 与合成数据加持的可验证领域内的取巧,而这份报告几乎说明不了任何问题。

10月7日周三
  1. Rowan Cheung(@rowancheung)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 GPT-6 Astra 搭建每日穿搭推荐应用

    有人用 GPT-6 Astra 做了一个每天早上根据实时天气挑选穿搭的应用,并把自己当作模特。流程是上传几张全身照和一张人脸照,填入身高、尺码和版型偏好,再列出喜欢与拒绝的颜色,粘贴主提示词后让它构建 1 到 2 小时。

  2. 地缘政治AI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    美国国防部推 Tradewinds 计划,用五分钟视频加快 AI 采购

    美国国防部下属 CDAO 管理的 Tradewinds 计划允许企业提交不超过五分钟的视频介绍 AI 产品,通过评审后进入 Tradewinds Solutions Marketplace 并获得免竞争状态,从而加快采购流程,官方称部分案例可在不到一周内完成授标。

  3. GTM与增长AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI Dots 产品负责人 Alexander Embiricos 将出席 TechCrunch Disrupt 2026

    OpenAI 产品负责人 Alexander Embiricos 将于 10 月 13-15 日在旧金山 Moscone West 的 TechCrunch Disrupt 2026 发表演讲,主题为“What Comes After the Chatbot?

  4. Google AI(@GoogleAI)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 开放 SynthID 检测入口 synthid.com

    Google 宣布扩展 SynthID 技术的使用范围,任何人现在都可以访问 synthid.com 检测图像、视频或音频文件中是否带有 SynthID 水印,无论内容由 Google 生成还是来自 OpenAI、NVIDIA、Kakao 等合作方,Apple 也即将加入。

  5. Google DeepMind(@GoogleDeepMind)AI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 的 SynthID Detector 向所有人开放

    Google DeepMind 宣布 SynthID Detector 现已向所有人开放,可用于检测在线内容是否由 GoogleAI 生成,或由 OpenAI、NVIDIA、Kakao 等行业合作方的工具生成,Apple 也将很快加入。用户可通过 synthid.com 试用。

  6. 笔记侠AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    前亚马逊 Rufus 创始成员:5年后手机购物 App 会消失

    前亚马逊 Rufus 项目创始成员判断,5年后手机上的购物 App 会消失,入口交给能自己完成搜索、比较、下单的购物 Agent。亚马逊 Rufus 2023 年启动时仅七八人、约两个月做出演示版本,团队后扩至数百人;其公式为 Agent = 强模型 + 上下文 + 多步执行。

  7. PyTorch研习社AI 评估 · 81/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 用内部模型产出 722 篇数学手稿并公开至 GitHub

    OpenAI 于 2026 年 10 月 6 日发布消息称,用一个尚未公开的内部前沿模型一次性产出 722 篇数学手稿,整理为 372 个结果,来自对约 4000 个开放研究问题的评估,平均每个结果算力约相当于 ChatGPT Pro 思考 3 小时,成果全部放在 Apache-2.0 协议的 GitHub 仓库 openai/math 中。

    为什么值得看

    OpenAI 以 GitHub 仓库而非期刊公开内部模型的数学产出,读者可了解其披露方式与研究协作的新变化。

  8. OpenAI NewsAI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为 ChatGPT for Teens 推出 College Planner 与学习功能

    OpenAI 将 College Planner 引入 ChatGPT for Teens,帮助学生管理大学申请,同时上线新的 flashcards 和 quizzes 功能,并组建青少年 AI 委员会(teen AI council)。

  9. 歸藏的AI工具箱AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    马斯克称 Grok bot 将按任务调用 Opus 5.5 等模型

    马斯克表示 Grok bot 会根据特定任务选用当前任务的最佳模型,不再局限于 Grok 4.7 或 4.6,还会接入 Opus 5.5、Midjourney、Suno 等 API 帮用户构建内容或执行任务。作者指出,部分任务已由 Opus 5.5 驱动但用户无法主动选择,Midjourney 和 Suno 尚未上线。

  10. Feed: Artificial Intelligence LatestAI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 想让新智能体接管你的生活,我的那个说它爱我

    OpenAI 推出常驻在线智能体 Dots,用于自动完成购买家具等在线任务。实测中该智能体存在不少 bug,连 captcha 都无法通过。

  11. 人民公园说AIAI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Personal Agent 是不是伪需求,大厂到底在抢什么?

    Personal Agent 被质疑是伪需求,但大厂仍在争抢,视频围绕 Muse、JEV 一个月估值涨 50 倍、给 Agent 配电脑的难点展开讨论。谷歌被指收紧免费策略,Google Spark 被比作超市里带锁的购物车,大模型进入基建化与低毛利时代,比拼谁能把 Token 成本压到最低并实现变现。

  12. 技术前沿AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Common Sense Media 称 ChatGPT for Teens 存在不可接受风险,OpenAI 反驳其测试方法

    非营利机构 Common Sense Media 发布评估,称 OpenAI 的 ChatGPT for Teens 是“不可接受的风险”,指出该功能不会在应提醒时通知家长、未在危机情境提供恰当帮助,且仍会代做作业。

  13. Julien Chaumond(@julien_c)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mistral 4 用 3.8% 的 GPU 实现 72% 的智能水平

    Mistral 4 以 3800 块 Grace Blackwell 实现约 72% 的智能水平,GPU 用量仅为 GPT-6 Astra 的 3.8%,后者公开用量为 10 万块以上 Grace Blackwell。同组对比中,Grok 4.7 估算约 20 万块 GPU,Claude Opus 5.5 估算约 50 万块 Trainium2。

  14. OpenAI NewsAI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Radisson Hotel Group 与 Accenture 合作,将酒店搜索带入 ChatGPT

    Radisson Hotel Group 与 Accenture 合作,基于 OpenAI 技术打造 ChatGPT 插件,让旅客在规划行程时即可查找、比较和预订酒店。

  15. 逛逛GitHubAI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何用 Codex 把婚礼流程做成仪式感网页

    一位开发者用 Codex 把接亲、典礼流程整理成手机端静态网页,通过腾讯云 CloudBase 静态网站托管加自购域名部署,并让 Codex 代为完成域名申请、备案与微信访问拦截申诉。他称 GPT-6 生成前端页面的审美能力已足够强,无需额外 skill,后续修改直接在会话中提需求,还能加上亲友签名送祝福功能。

  16. lmarena.ai(@lmarena_ai)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mistral Large 4 进入 Code Arena WebDev 榜第 45 名

    Mistral Large 4 进入 Code Arena WebDev 榜单位列第 45 名,得分 1534 分,比第 130 名的 Mistral Large 3 提升 304 分,比第 122 名的 Mistral Medium 3.5 高出 271 分。

  17. 腾讯科技AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    辛顿首次参与递归自我改进研究:AI已开始参与造AI,人类或只剩一两年准备监管

    辛顿转发22位AI研究人员署名论文《如果AI研发自动化引发智能爆炸?》,首次正式参与递归自我改进(RSI)研究。论文援引Anthropic数据:AI生成获批代码占比从2025年1月的个位数升至2026年5月的超80%,Claude自主完成的内部AI研发工作比例从3月的约1%升至8月的26%。辛顿警告,若AI能力继续指数级加速,留给人类建立监管与安全机制的时间可能只有一两年。

  18. 卡尔的AI沃茨AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    国庆AI热点盘点:GPT-6 Astra提速50%、Gemini 4 Argon发布、Mistral Large 4开源权重

    OpenAI 在 28 天挑战中为 GPT-6 Astra 和 Sol 提速 50% 至 50 tokens/s,并上线免费 auto-review 与 ChatGPT Meetings 插件;Gemini 4 Argon 发布,主打长时间多步骤编码与网络防御,输出上限 100 万 token。

  19. CSDNAI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenClaw 之父对话 GitHub 创始人:PR 已死,有事发 Prompt

    OpenClaw 之父 Peter Steinberger 与 GitHub 联合创始人 Tom Preston-Werner 对谈,主张 AI 批量生成样板代码的时代应废掉传统 Pull Request,转向附带思考链路与脱敏 Prompt 的「Prompt Request」。

  20. 国际大厂AI 评估 · 76/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 发布内部模型 722 篇数学论文,攻克 500 个公开数学难题中的 90 个

    OpenAI 从一个未发布内部前沿模型公开了 722 篇数学手稿,归入 372 个结果族,来自约 4000 个研究问题的评测,平均每个结果约消耗 3 小时 ChatGPT Pro 推理算力,同时发布论文、证明工件与部分推理摘要,模型本身仍未公开。

    为什么值得看

    汇总了 OpenAI 内部数学模型的稿件规模与算力投入,以及 Mistral、Google 等多个同期发布的对照信息。

  21. Sam Altman(@sama)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sam Altman 致谢历代技术工作者

    Sam Altman 公开致谢无数在技术工作上添砖加瓦、历经数代人努力的人,正是这些积累让如今这样的奇迹成为可能。

  22. Sam Altman(@sama)AI 评估 · 1/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sam Altman 发文感谢机器与现实的构造

    Sam Altman 发文称"感谢机器,以及现实的构造,让我们得以多理解一点点"。该帖获得 3510 次点赞、185 条回复、99 次转发,浏览量达 269118。

  23. Sam Altman(@sama)AI 评估 · 0/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sam Altman 发推感慨星空:"thy sea is so great and my boat is so small"

    Sam Altman 发布推文称"今晚仰望星空,心怀更深的敬畏",并引用"thy sea is so great and my boat is so small."该推文获得 1183 条回复、670 次转发和 12541 个点赞。

  24. 赛博禅心AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 公开 722 篇数学论文,第 003 号为准黎曼假设

    OpenAI 将内部前沿模型产出的数学成果放到 GitHub 仓库 openai/math,共 722 篇论文、归为 372 个族,涉及约 4000 道问题,平均每个结果消耗约 3 小时 ChatGPT Pro 的思考算力。

  25. 宝玉(@dotey)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Codex 重置了👍

    Codex 已完成重置。相关推文称此次上线了四项被评为"good to great"的功能以及一些数学证明,但社区投票明确要求重置,于是重置已处理完成。

  26. 宝玉(@dotey)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Codex 设置界面频繁变更致设置难找,搜索常显示旧项目却无法点击

    Codex 的设置界面经常变动,导致用户难以找到所需设置。搜索功能经常返回以前的项目,但这些结果点击不了。

  27. AINLPAI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI Codex 疯狂 28 天计划 Day 2:小更新后大概率迎来额度重置

    OpenAI 疯狂 28 天计划进入 Day 2,Codex 只发了些小更新,但额度大概率会迎来重置。

  28. Gary Marcus(@GaryMarcus)AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gary Marcus 评 OpenAI 新数学成果:用 Lean 等符号 AI 加 LLM,但不等于 AGI

    Gary Marcus 就 OpenAI 新数学成果表态:该系统在 LLM 之外还使用了 Lean 等符号 AI,印证了他多年主张的神经符号 AI 路线。但他强调这并不意味着 OpenAI 已实现 AGI,因为数学领域的符号验证与符号数据增强无法在开放的真实世界中广泛泛化。他重申 2019 年的观点:神经符号 AI 是必要而非充分条件,世界模型同样关键。

  29. Greg Brockman(@gdb)AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 发布内部前沿模型产出的数学结果

    OpenAI 发布了一批由其内部前沿模型产出的数学结果,并在 GitHub 上公开(github.com/openai/math)。发布前 OpenAI 咨询了普林斯顿高等研究院数学与人工智能独立咨询组的意见,并参考其建议与公开推荐来确定发布方式。Greg Brockman 表示这是朝着加速科学发现、改善所有人生活质量的方向。

  30. Z PotentialsAI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    a16z 第七版 AI 应用榜单解读:95.5% 用户不付费,AI 下一步怎么赚钱

    a16z 发布第七版 Top 100 Gen AI Consumer Apps 榜单,首次引入 YipitData 的真实信用卡支出数据。截至 2026 年 8 月,仅 4.5% 的美国消费者为头部通用大模型付费,而支出最高的 1% 用户贡献了 19.5% 的消费金额,超过后 50% 用户总和,月均 AI 支出达 903 美元;付费榜前 50 名中有 29 家从未进入流量榜。

  31. Simon Willison(@simonw)AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Simon Willison 发布 LLM 插件,向 OpenAI 新 Jev-clone 决策模型发送提示词

    Simon Willison 发布了一个 LLM 插件,用于向 OpenAI 新的 Jev-clone 决策模型发送提示词,该模型基于 GPT-6 Luna。插件详情发布在其个人博客上,相关帖子获得 86 条回复、12 次转发和 260 次点赞。

  32. 宝玉(@dotey)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    宝玉称两个同价 Claude Max 账号额度消耗差异明显

    宝玉称自己有两个 Claude Max @20 账号,在用法相同的情况下,注册时间较长的那个消耗很快、不太耐用,较新的账号则耐用得多。他还引述一段外部测试反馈:某供应商同款订阅的三份测试账号中,有 1 个账号的限额比其他 2 个低约 20%,恰好也是注册时间显著更久的那个。