Paul Graham:你的使用限制就是我的机会
Paul Graham 发帖称"你的使用限制就是我的机会",该帖获 2741 点赞、116 转发、72 条回复,浏览量约 49.9 万。帖文未点名具体产品或服务,仅以一句话表达对竞品使用限制的态度。 (说明:原文正文仅一句观点加互动数据,无模型、版本、benchmark、价格等可核验事实,故摘要保持极简,未做任何外部推断或主体补全。)
Paul Graham 发帖称"你的使用限制就是我的机会",该帖获 2741 点赞、116 转发、72 条回复,浏览量约 49.9 万。帖文未点名具体产品或服务,仅以一句话表达对竞品使用限制的态度。 (说明:原文正文仅一句观点加互动数据,无模型、版本、benchmark、价格等可核验事实,故摘要保持极简,未做任何外部推断或主体补全。)
Paul Graham 认为,任何封禁 AI 智能体的业务都为创业公司留出了做竞品的机会:既然需要封禁,说明用户想用,也就意味着存在允许使用智能体的替代品的需求。
全球大模型每百万 token 平均价格已跌破 1 美元,从 5 月的 2.05 美元在三个多月内腰斩,但 AI 会员订阅费却齐刷刷上涨,部分翻了好几倍。订阅打包的是高级功能资格、用量上限和高峰期优先权,厂商用点数、次数、消息数替代 token 披露,形成随时可调汇率的黑箱。
从 GDC、ChinaJoy 到科隆游戏展,Agent 游戏成为 AI 游戏讨论的高频词。Magic Find Ventures 少云、《积案拂尘》开发者简律纯与《405游局》主理人筱宁认为,更自由的 NPC 不一定意味着更好的角色,生成内容也不等于新玩法;AI 能把 Demo 从 0 分做到 70 分,但走向真正好玩的游戏仍需大量人工打磨。
Spring 的 A Bootiful Podcast 本期对话传奇 Java 开发者 Kohsuke Kawaguchi,回顾他在 Sun 参与 JDK 中 XML 与 Web 服务基础设施的经历,以及 Com4J、XML schema 校验器、守护进程工具等项目的由来。
Amjad Masad 回应 @Molson_Hart 称,该平台覆盖从构思、设计、开发、评审到部署、安全与 DevOps 的完整流程,只要用例足够复杂,用户需要操心和处理的事会少得多。
Ben Affleck 自称会写"相当糟糕的" Python 脚本,长期关注计算机与电影从模拟向数字的转变。他提到视觉特效流程多年来已用到机器学习,用卷积神经网络(Transformer 的前身)在 tensor 上做边缘检测和特征提取,从而更轻松地抠掉绿幕画面并替换背景。
工程社区将重新发现,每个程序都能被无限加固(压掉边界情况、收紧输入、处理错误)和优化(做 profiling、跑 benchmark、重写)。Guillermo Rauch 指出两个方向都有真实成本:时间、注意力与机会,你可能一直在探索永远不会被触发的输入空间,或优化永远不会被使用的性能。他强调即便在 token 无限的世界里,也需要知道何时停止、接受哪些取舍,而智能体会不计代价地一直钻下去。
伊朗战争使英国公共财政损失 120 亿英镑。本期 FirstFT 还关注中欧贸易与英国抵押贷款利率。
WSJ 观点文章主张用物理学而非政策来监管 AI 行业:没有足够清洁电力运行,就不应新建数据中心。文章以电力供给作为 AI 扩张的硬约束。
尼日利亚学生 Victor Ayebameru 在新加坡举办的量化竞赛中夺得第一名,该赛事被视为发掘未来对冲基金明星的舞台。人工智能正在改变这场"量化奥林匹克"的竞争格局。
数学注定最先被 AI 攻克,学科越纯粹,AI 越容易破解。这条观点由 Amjad Masad 提出,认为纯数学这类形式化程度高、验证标准清晰的领域,比依赖经验和模糊判断的领域更容易被 AI 突破。
Sam Altman 表示自己等这个新版本等了很久,并称不愿再回到旧版 Chat。推文未披露新版 Chat 的具体版本号、功能细节或上线范围,仅以"新版"和"旧版"作对比。
观点文章认为,AI 卢德分子不会获胜,因为人工智能满足了真实的社会需求,不会消失。
一条关于"数学是否已被解决"的讨论帖获得 19 条回复、6 次转发、87 个点赞和 9587 次浏览。
三名工程师把 GPT、Claude 和 Grok 接入一辆真实的丰田卡罗拉,让它们分别负责驾驶,目标是开到 In-N-Out。三家模型里只有一个成功完成任务。
Gary Marcus 与 Terence Tao 就 OpenAI 的数学大模型发布发表互补评论,试图厘清数学研究中的新范式。相关内容发布于 Gary Marcus 的 Substack 专栏。
Gary Marcus 与 Terence Tao 就 OpenAI 新公布的数学成果发表互补评论。Marcus 指出,OpenAI 仅称"用同一流程、借助未发布模型"完成证明,未披露架构、失败率、训练与数据增强细节,还提到证明是否由 Lean 一次性生成并验证也不清楚。他认为无法判断该结果的通用性,甚至无法排除其只是借助 Lean 与合成数据在可验证领域取巧。
Neville Medhora 发推感叹"很高兴再也看不到 AI 传单了",Justine Moore 转发并称这是"别人扎堆时反向突围"的绝佳案例。
Gary Marcus 批评 OpenAI 一份关于未发布模型的报告信息严重不足:未说明具体方法、架构、失败率以及训练、后训练和数据增强细节,也未交代证明是否由 Lean 一次性生成并验证。他认为外界因此无法判断该结果在数学之外的可泛化性,该系统究竟通往 AGI 还是仅靠 Lean 与合成数据在可验证领域取巧,从报告中几乎看不出来。
Guillermo Rauch 发布一条推文"gm from the best city in the world",获 913 个点赞、59 条回复、14 次转发和 4.8 万次浏览,数据由 xgo.ing 提供。
数学家 Terence Tao 表示,AI 工具在负责任使用的前提下,不仅能生成初始解决方案,还能支撑传统上由此衍生的一系列有价值的后续工作。但他指出,当前情况往往恰恰相反。
数学家 Terence Tao 在 X 上发了一条调侃式帖子,配文"terence tao, shitposting🤣"。该帖获 1386 个点赞、121 次转发、35 条回复,浏览量 116024。
"iPod 之父" Tony Fadell 认为,第一代 AI 硬件未能解决真实问题,因而遭遇失败;他指出下一波产品必须赢得消费者信任。
Jim Fan 认为,人类很可能先证明黎曼猜想,再通过"物理图灵测试"——即狂欢派对后回家,分不清打扫房间的是人还是机器人。他指出,我们目前对莫拉维克悖论(Moravec's paradox)的重视程度还远远不够。
Stacklok 由 Kubernetes 两位创始人 Craig McLuckie 与 Joe Beda 打造,目标是把 AI 智能体 harness 完整带入云端,做成"云原生 harness"。他们认为,尽管 OpenAI 和 Anthropic 近期进展显著,云端智能体 harness 至今仍未完全解决,也因此不再需要一直开着笔记本电脑。
前亚马逊 Rufus 项目创始成员判断,5年后手机上的购物 App 会消失,入口交给能自己完成搜索、比较、下单的购物 Agent。亚马逊 Rufus 2023 年启动时仅七八人、约两个月做出演示版本,团队后扩至数百人;其公式为 Agent = 强模型 + 上下文 + 多步执行。
JetBrains 对从 16 人软件公司到数千人开发团队的工程组织调研发现,个人开发者用 AI agent 提速明显,但团队层面收益停滞:某金融数据商约 80% 工程师每天使用 agent,却出现 20% 工程师产出 80% 代码的鸿沟。瓶颈转移到代码审查与规划阶段,有团队测得 PR 时间反而增加;把重复工作交给 agent 也带来新的维护负担。
Aaron Sorkin 为《社交网络》打造的续集《社交清算》,试图让一个已被证明毫无羞耻心的统治阶层感到羞耻。
Eli Lilly 和 Novo Nordisk 称,服用其 GLP-1 减肥药的患者在追踪 DNA 与关键蛋白变化的分子“衰老时钟”上衰老更慢,但这一结果的解读仍存疑问。
Aadit Sheth 指出 Instinct、Muse、Hark、Dots、Grok Bot 等智能体产品都在做同样的东西,定价也清一色是免费、$20/mo、$100/mo,他认为最终只会有一两个赢家,且大概率出自已经获得用户信任的大型科技公司 Google 或 Apple。
汤姆·克鲁斯主演的《Digger》票房失利,预告片把它当搞笑片段集锦来卖。这部他职业生涯中最奇怪的电影,或许是对当下科技与气候时代最令人不安的一幅写照。
Sapient Intelligence 联合创始人 William Chen 分享了自己在中国求学、同时保持与硅谷连接的体验。他在采访中谈及如何做到"两全其美"。
Personal Agent 被质疑是伪需求,但大厂仍在争抢,视频围绕 Muse、JEV 一个月估值涨 50 倍、给 Agent 配电脑的难点展开讨论。谷歌被指收紧免费策略,Google Spark 被比作超市里带锁的购物车,大模型进入基建化与低毛利时代,比拼谁能把 Token 成本压到最低并实现变现。
Apple 在智能家居上采取比预期更聪明的路线,通过与 LG 等合作伙伴深度整合切入。Amazon 面对智能体标准问题需要作出应对。
极限编程(XP)创始人 Kent Beck 在 Prodacity 2026 演讲中指出,AI 生成 20 万行代码只属于 Effort 和 Output,离 Outcome 与 Mission 还有两层,不能代表生产力。
美国财政部长贝森特(Bessent)领导的财政部正面临人员流失与目标未达的双重压力。此外,节目还呈现了执行美国对伊朗封锁的无线电指令,并采访了10月7日之后移居以色列的年轻美国人。
从农业就业占比由 90% 降至约 1%、电话接线员和打字员岗位消失,到 Minneapolis 市议会要求自动驾驶汽车配备人类安全员、New Jersey 要求加油需专人操作,技术进步一贯以岗位冗余为代价。软件创造成本骤降可能带来应用与服务爆发,同时需要智能体管理者,但部分公司对程序员的需求会减少,另一些则会首次招聘或大幅扩编。
喜马拉雅资本创始人李录在哥伦比亚商学院对谈中主张为 AI 划红线,要求其自我学习和工具使用不能脱离人类参与,并称这项技术"非常有用"也"极其危险"。他同时分析中国经济信心不足与制造业升级并存的分化局面,并指出技术制裁反而为中国半导体产业带来了宝贵的市场需求。
Mistral 4 训练使用 3,800 块 Grace Blackwell,约为 GPT-6 Astra(100,000+ 块)、Grok 4.7(约 200,000 块)和 Claude Opus 5.5(约 500,000 块 Trainium2)的零头。