DeepSeek V4 Flash 价格下探十倍,Google DeepMind 被指高层地震?
播客节目讨论 DeepSeek V4 Flash 把价格打下十倍,在硅谷划出一道“斩杀线”,并称 Google DeepMind 爆发高层大地震,哈萨比斯退居二线、Jeff Dean 离职。节目还谈到中间层模型面临的淘汰压力、Google 的路线之争,以及谁会成为下一个“美国版 DeepSeek”。
播客节目讨论 DeepSeek V4 Flash 把价格打下十倍,在硅谷划出一道“斩杀线”,并称 Google DeepMind 爆发高层大地震,哈萨比斯退居二线、Jeff Dean 离职。节目还谈到中间层模型面临的淘汰压力、Google 的路线之争,以及谁会成为下一个“美国版 DeepSeek”。
Adam D'Angelo 认为,AI 领域的边际收益递减不像传统软件开发那样强烈,价值都集中在前沿。他指出知识蒸馏虽有损害,但不足以抵消规模经济效应。
昆山杜克大学社会学家周忆粟在播客中谈 AI 对教育的冲击:学生学习出现认知外包,而新手变熟手依赖的合法的边缘性参与正被 AI 替代,junior 的上升梯子被抽掉。
AI 科学家贾扬清在「声东击西」十周年串台中回顾从「人工智能已死」到「AI 颠覆世界」的历程,并透露其第二家公司 Intent Lab 已于上周官宣。他讲述从 Google Brain、Facebook AI Research 到阿里的经历,包括由一张快递盒送来的英伟达 GPU 促成开源工具 Caffe 诞生,以及首次创业 Lepton AI 第二年实现盈利后被英伟达收购。
Jeff Dean 宣布在 Google 工作 27 年后离职,并将与 Sanjay Ghemawat、Oriol Vinyals、Quoc Le 共同创办 DiscoLoopAI。他在内部信中回顾 Google 从 25 人发展到 190,000 多人,并称公司现有 13 款产品用户超过十亿。
Jeff Dean 在 X 上晒出 pitch deck 中的又一张趣味幻灯片,该帖获 1607 个点赞、52 条回复、36 次转发和 37.4 万次浏览。
Jeff Dean 表示其团队的整体思路是自动化实验闭环,认为该方法可广泛适用于多个科学与工程领域。团队初期将聚焦机器学习研究与工程,并相信它能帮助解决美国国家工程院(NAE)十四项重大挑战中的诸多子问题,做好此事需要机器学习与大规模系统方面的深厚专长。
Dia 官方回应用户对其 morning brief 功能的称赞,表示在 AI 时代用心的设计将重要 10 倍。有用户称 Dia 拥有最好的 morning brief,认为这是用心设计带来差异的又一例证。
xAI 前推理团队负责人、开源推理引擎 SGLang 发起人盛颖离开 xAI,联合创立 RadixArk,原因是 SGLang 社区快速扩张后仅靠开发者业余时间维护已无法支撑项目继续向前。她曾在早期 xAI 参与搭建生产级推理系统,并称那段时间同时拥有 "support" 和 "freedom"。
Rowan Cheung 在 X 上发布了完整采访的视频链接,指向 YouTube。该帖互动数据为 6 条回复、5 次转发、14 个点赞、9709 次浏览。
Sam Altman 在访谈中用农民视角解释 AI 与未来工作:过去的人会认为今天的工作不算"真正的工作",未来职业可能像游戏,但对他而言依然真实。他承认转型期存在短期担忧,但相信人类驱动力会让大家找到足够多的事做。
Martin Fowler 发布新一期 Fragments,收录了关于失控智能体(rogue agents)责任归属、AI 泡沫破裂信号、对 AI 的恐惧,以及对 gov.uk 的赞赏、从封闭软件包中提取数据等话题。
前华为天才少年黄青虬创办的墨奇智能成立于 2025 年底,半年内完成超 10 亿元天使轮融资,他现任联合创始人兼 CTO。黄青虬认为具身是马拉松而非百米冲刺,技术范式尚未收敛,起点差几个身位区别不大。他判断 VLA 和世界模型都不够本质,今年能产出 5000 台靠谱机器人的公司不会超过三家,且具身数据质量远比数量重要。
Yann LeCun 回应质疑称,其言论针对的是纯 LLM 所做的自回归 token 预测,而优秀的代码生成系统并非纯 LLM,也不只是在做自回归 token 预测。
Yann LeCun 指出,在推理时进行优化是能量基模型(EBM)与目标驱动 AI 架构(ODAI)的基础概念。当需要推断的变量是连续的,使用基于梯度的优化就是合理的;基于世界模型的系统用梯度优化做规划,是 ODAI 的一个好实例。
Yann LeCun 回顾了数学与计算在学术界的紧密关系:Richard Courant 于 1928 年提出数值求解 PDE 的方法,Von Neuman 在 1940 年将其与电子计算机结合,二人皆为数学家,这些方法是有限元方法的前身。
Junyang Lin 表示,sama 也曾说过类似的话,并向其致以极大敬意。该帖获得 1 个点赞、897 次浏览。
Naval 提出 "Agent Programming Interface"(智能体编程接口)这一概念,该帖获 6760 点赞、376 次转发、近 59 万次浏览。帖子未展开具体技术细节或产品信息。
BAI Capital 高级合伙人汪天凡在「十字路口」公路播客中提出,当基础模型趋同、智能开始通胀时,AI 应用的新机会藏在 Context 和交互里,而 AI 硬件真正稀缺的是产品定义与「注入人性的光辉」。他认为 2026 年泡沫中更该下注想清楚为何出发的创业者,并称 AI 是压缩进 30 年的 3000 年文明变革,门槛可能只有 1% 的人能跨过。
Kevin Weil 称 OpenAI 团队的十项成果均为该领域重大结果,并祝贺 @SebastienBubeck、@polynoamial、@markchen90、@merettm 及整个 OpenAI 团队。他表示难以想象全世界都能使用这一模型时的情形。
桥水基金创始人 Ray Dalio 在最新专访中判断,当前正处于典型的 AI 投资泡沫中,同时身处一轮约 80 年的大周期终局,债务积累、贫富差距扩大与世界秩序权力转移正在同步发生。
硅谷101播客邀请前Hugging Face亚太开源生态负责人王铁震与TinyFish联合创始人Keith Zhai,讨论中国开放模型逼近前沿引发的蒸馏争论。7月27日月之暗面发布Kimi K3完整模型权重,自7月16日API上线以来K3在多项测试中接近前沿模型能力。
Claude 的部分决策规则属于绝对硬约束,与大多数决策所遵循的细致成本收益分析不同,这些约束不可协商,任何操作者或用户都无法解锁。正因其绝对性,硬约束在文档讨论的各类优先级中运作方式也不同。
《晚点聊》主播曼祺与《晚点 LatePost》主笔高洪浩对谈姚顺雨加入腾讯300天给混元带来的改变,相关报道为《当一个年轻人空降改造腾讯混元的300天》。节目提到,姚顺雨到任后先更换关键岗位再重建组织,多模态并入使其管理范围持续扩大,刘炽平在钱、人、算力和时间上给予支持,混元3的第一炮目标不是登顶而是重振士气。
Jeff Dean 在 Startup School 2026 与 YC 的 Sanjay Ghemawat 对谈,回顾 2001 年算出 Google 搜索索引可全部放进 RAM、2013 年从"每用户每天三分钟语音识别"的推演催生 TPU。他谈到 AI 智能体将连续运行数周、长时智能体失败的原因,以及推理硬件是下一个专门化方向、上下文工程是下一前沿。
清华大学人工智能学院助理教授刘子鸣在访谈中用“太疯狂了”形容当下中美 neo labs 的融资热度,他本人是 KAN 网络一作,今年 3 月回国任教并参与创建公司元环智能。他指出当前资本涌入最活跃的两个方向是世界模型和 AutoResearch(AI for AI),并梳理了今年中美做 AI for AI 的创业团队与路线。
DeepSeek 梁文锋一场闭门讲话被解读出理想主义背后的成本账:硬件约 10 个月回本、API 按成本 6 倍定价,融资的钱继续买卡,“反正开了你也做不了”被视为真正的成本壁垒。讲话还涉及用 TileLang 重构底层算子绕开英伟达生态,以及 Claude 加一两个工程师就完成 AMD 硬件适配原型。开源被形容为试吃,护城河藏在工程化与上下文里。
Richard Socher 在 AI Engineer 大会首次 Autoresearch 专场发表主题演讲,介绍 Recursive_SI 正在构建用于递归自我改进的 Eureka Machine,目标是为人类实现科学发现自动化,并将其称为超级智能最有意义的应用。他同时指出距离这一目标仍有很长的路要走。
Scott Wu 推荐了 Hemant Taneja 的 Q2 回顾。该回顾围绕"极端集中化结果时代,风投如何更好服务创始人"展开,涵盖 The Great Concentration、Fixing the K-shaped Economy、The Stack as the Antidote 等主题,并与 Packy McCormick 进行了对话。
Yann LeCun 指出,业界从事的基础研究远少于大学。Bell Labs、IBM Research、Xerox PARC 等工业实验室曾做出重要科学贡献,但这一传统在 1990 年代消失;微软研究院在 2000 年代接棒,Google 与 Meta 随后跟进约十年。他认为这些机构的创新几乎都建立在学术工作之上,并受益于整个研究生态。
马斯克在《经济学人》访谈中预测,AI 可能在 5 年内超过人类智能总和,10 年内进入超级智能时代,届时人形机器人驱动的"准无限经济"将使金钱在 2036 年不再重要,工作变成类似"园艺"的可选项。他仍估计 AI 消灭人类的概率在 10% 到 20%,建议领先公司互相提供一到两周的前沿模型早期访问测试。
演语科技 Evoken 创始人陈冕在《晚点聊》中回应外界对公司的争议,包括原创度质疑、投流与补贴误解,以及收购传闻。Evoken 旗下有 Liblib、Lovart、LibTV 三个产品,ARR 超过 3 亿美元,并以 20 亿美元估值一笔融了 3 亿美元。陈冕称公司不是负毛利,LibTV 3.9 折会员仍在探索高 Token 消耗的生产力产品商业模式。
Mustafa Suleyman 在 X 发布一篇长文,附 x.com/i/article/2082… 链接。该帖获得 35 条回复、42 次转发、396 个赞和约 69.6 万次浏览。
Cognition CEO Scott Wu 在巴黎与 Molly O'Shea 对话时透露,Devin 现已编写 Cognition 约 95% 的代码,高于 5 月 D 轮时的 89%。
Satya Nadella 转发并赞同 Mark Zuckerberg 的一篇文章,称构建一个赋能各地个人与组织的前沿生态是大家需要共同建设的目标。Zuckerberg 表示他撰文解释了为何相信未来属于所有人,并称很快会给出关于超级智能世界的积极愿景。
Jim Fan 表示强化学习的关键在于环境(envs),而 Real2sim2real 是为物理 RL 扩展环境的最佳方式之一,并就此向李飞飞表示祝贺。
Rowan Cheung 在 X 上发布了完整访谈的视频链接,指向 YouTube。该帖附带互动数据,浏览量达 16366 次。
Mark Zuckerberg 称 Meta 超级智能实验室只需 50 到 100 人,因为这些顶尖研究者能同时把整个项目装进脑子里,他本人亲自招募了每一位顶级研究员。他的管理原则包括不设自上而下的截止日期,因为研究无法预估耗时,并保持组织扁平、不设非技术管理层,理由是管理者一旦停止动手,知识就会衰减。
导演易小星与粉墨团队导演李晨在播客中讨论 AI 拍电影,其合作作品《女娲之死》获 B 站创作大赛奖项。两人坚持用粘土风对抗 AI 塑料感,提出"人定美学,AI 执行"的工作流,认为技术平权后好故事成为唯一稀缺品,AI 写不出基于预期违背的喜剧段子。他们预测未来或有超 50% 画面由 AI 参与制作,但真人实拍与 AI 创作将长期并存。
李继刚提出"真、诚、勇、敬"四字准则:真即不欺己,诚即不欺人,勇即不避事,敬即不强人。该内容获34次点赞、9173次浏览,由 xgo.ing 提供支持。