Martin Fowler 谈软件开发静修随想:把 LLM 当函数用、别用 LLM skills
Martin Fowler 在最新 Fragments 中记录软件开发静修会的若干思考:主张把 LLM 当作函数来使用,而不建议使用 LLM skills;他还追问若没有文本编辑器自己是否还能成为写作者。
Martin Fowler 在最新 Fragments 中记录软件开发静修会的若干思考:主张把 LLM 当作函数来使用,而不建议使用 LLM skills;他还追问若没有文本编辑器自己是否还能成为写作者。
这期访谈对话 Shopify 前基础设施负责人 Simon Eskildsen,聊了他扩展 Shopify 应对闪购与宕机的经历、打造 turbopuffer 的经过,以及数据库的未来。对话还涉及 Napkin Math 博客、新数据库公司为何持续胜出、AI 编程与智能体目前仍失败的地方,以及 AI 时代招聘 P99 工程师。
Richard Socher 分享了一篇文章,链接为 x.com/i/article/2054…。该推文获得 39 条评论、58 次转发、454 个点赞和 90071 次浏览。
理想汽车创始人李想做客罗永浩播客《十字路口》,介绍已完成从汽车公司向 AI 和具身智能公司的阶段性转型,并发布新一代旗舰 SUV L9 Livis。L9 Livis 搭载理想自研马赫 M100 芯片,算力达 2560 TOPS,配备全球首个完全体全线控底盘与 800V 主动式悬架系统,定位五十万元左右档位。
吴恩达(Andrew Ng)公开反驳"AI 就业末日"叙事,指出 AI 虽然影响就业,但软件工程师招聘依然强劲,美国失业率仍维持在 4.3%,净就业创造远大于岗位消失。他认为这一叙事流行源于前沿 AI 实验室夸大技术能力的动机、AI 公司按员工薪资而非 SaaS 价格定价的商业逻辑,以及企业借 AI 之名解释裁员的偏好。
Demis Hassabis 发布了一条附带阅读链接的推文,指向 bit.ly/4v2OI03,未在推文中说明具体内容。该条推文获得 562 次点赞、52 次转发和 15 条回复。
潘乱与衣鹏在「乱翻书」复盘头腾大战:2018年5月8日张一鸣与马化腾朋友圈争论引爆冲突,青少年话题、诉讼与问询接连失控,双方事后都承认本不该打。节目还把天天快报2800万DAU后自废武功、微视重启、2020年上线的视频号、多闪、字节做不出3A大作,以及阅文vs番茄、腾讯视频vs红果等战场逐一拆开,并称字节已在AI业务上主动进化。
Cognition AI 联合创始人 Scott Wu 回应 Colossus 杂志文章中他与 Mango 的对战传闻,称当时在 Founders Fund 游戏之夜打了多局《任天堂明星大乱斗》,设备延迟严重,他只赢下一局,且 Mango 用的是 Falcon 并未尽全力,因此不认同"beat him to a pulp"的说法。
Anthropic 旗下 Claude Code 和 Cowork 产品线的工程与产品负责人 Fiona Fung 在 Code with Claude 2026 大会上用不到三十分钟分享了 AI 时代管理工程团队的实践。
Geoffrey Hinton 公开反驳 Gary Marcus 关于大语言模型「只是复述训练数据」的说法,称这一观点「很愚蠢」,并引用 Marcus 原话「它只是把不同的文本簇拼凑起来」作为佐证。该帖获 928 次点赞、41322 次浏览。
Richard Socher 回应"AI 是否存在泡沫",认为智能如同能源,很难出现供给过剩。他以早期互联网为例,指出人们当年低估了通信变便宜变快后需求的弹性,没有预见到互联网催生的全新通信方式。他判断人类对智能的需求近乎无限,短期市场动态或有波动,但 AI 将像人类智能一样日益渗透生活各方面。
前Anthropic、现Google DeepMind研究科学家姚顺宇参与过Claude 3.7、4.5和Gemini 3的开发,他在访谈中称AI个人英雄主义时代已经过去,现在是集体主义的故事,并对神话个体的叙事保持警惕。他认为"智能涌现"本身不科学,更多是主观感觉而非客观现象,本质是技术上实现了可水平提升所有能力的scale up。
前理论物理研究者姚顺宇转行AI后,先后在Anthropic和Google DeepMind任研究科学家,参与Claude 3.7、4.5和Gemini 3的开发。他在访谈中称AI个人英雄主义时代已经过去,现在是集体主义的故事,并提醒对神话个体的叙事保持警惕。
英伟达 GEAR Lab 负责人 Jim Fan 在 Sequoia AI Ascent 2026 的《Robotics' End Game》演讲中宣布 VLA 路线过时,包括他此前主推的 GR00T,提出以世界动作模型(WAM)为新范式,代表作是 2 月发布的 140 亿参数 DreamZero。
Kevin Weil 转发并评论称某议题"极其重要",同时称赞相关文章是"最好的写作之一",并附上《大西洋月刊》杂志链接。该帖获得 5 条回复、2 次转发、75 次点赞和 21220 次浏览。原文未披露所涉议题的具体内容。
Demis Hassabis 晒出 2016 年与 2026 年韩国广告牌对比,感叹这十年变化之大。
Jan Leike 公开致谢多年来共同从事对齐研究的同仁,称与这些致力于让未来向好的人共事是一种荣幸。原帖未提及具体模型、机构或研究进展。
Jan Leike 回顾,10 多年前刚开始研究对齐问题时,全领域只有约十几个人兼职在做,没人知道 AGI 会怎么被造出来、又该如何保证其安全。如今 RLHF 在 LLM 上的应用让对齐研究变得更可行,Claude 已有 constitution,可扩展监督取得进展,越来越多的对齐研究正在被自动化。
Jim Fan 在 2025 年 5 月 Sequoia AI Ascent 上发表了题为 The Physical Turing Test 的演讲,相关视频已在 YouTube 上线。
Jim Fan 在红杉 AI Ascent 演讲《Robotics: Endgame》中,把解决 Physical AGI 的路线类比 LLM 的成功路径,指出 VLA 的不足,并提出视频世界模型作为第二预训练范式、World Action Models(WAM)以及机器人数据飞轮等方向。
Fellou 认为,AI 时代的赢家不是最会写代码的人,而是对真实问题理解最清晰、能最快把想法变成用户反馈并抢先迭代的人。其核心观点是代码从来不是护城河,分发才是,而工具终于开始跟上这一现实。
在 5 月 6 日的 Code with Claude 旧金山场,Anthropic 兄妹 Dario Amodei 和 Daniela Amodei 同台对话,Dario 称公司原本按每年 10 倍准备算力,但 2026 年第一季度增速年化约 80 倍,这是 Claude 一直限速的直接原因,他直言 80 倍太疯狂、希望回落到 10 倍。
吴恩达指出,编码智能体对软件工作的加速按前端、后端、基础设施、研究依次递减。其中前端因智能体熟悉 TypeScript、JavaScript 及 React、Angular 等框架,且能借助浏览器验证结果自我迭代,提速最明显;后端因需人工引导处理边界情况、潜在 bug 和安全漏洞,加速幅度较小;基础设施任务中智能体效果最弱,其知识仍相对有限。
Anthropic 内部 Claude Code 创建者 Boris Cherny 在 Sequoia AI Ascent 访谈中表示,他整个 2026 年没写过一行代码,每天合并几十个 PR,工作方式变成在 Claude App 里同时管理几百个 Agent,靠 cron 驱动的 Loop 模式自动盯 PR、修 CI、抓取反馈。
Daniel Miessler 认为,多数公司用不上 AI 并非技术不成熟,而是自身愿景和目标模糊、朝令夕改,连想优化什么都说不清。真正被 AI 赋能的,恰恰是那些能清晰描述问题、目标、工作流和核心指标的公司;做不到这一点的大企业将面对小公司借 AI 发起的“降维打击”。
Demis Hassabis 在 Sequoia AI Ascent 与 Konstantine Buhler 进行炉边对话,视频已获授权公开。他谈到游戏作为 AI 训练方式、创办 Google DeepMind、DeepMind 与 AGI 以及 AI for Science 等话题,并提及其最爱的书是关于万物理论、其毕生工作横跨桌游到诺贝尔奖级科学。
Demis Hassabis 在 Y Combinator 的 How to Build the Future 节目中与 Garry Tan 对话,讨论通往 AGI 还缺什么,并指出记忆问题至今仍未解决。他还谈到 AlphaGo 如何影响 Gemini、小模型为何越来越强、持续学习与 AI 智能体的未来,以及从 AlphaFold 走向虚拟细胞。他建议创始人思考在 AGI 到来之前该构建什么。
Andrej Karpathy 表示,OpenAI 的 VPT 曾在 2022 年令他震撼,如今 SI 将这一思路扩展为 FDM1,并应用于知识工作与计算机使用场景。他对此感到兴奋,期待看到更多进展。
Andrej Karpathy 表示,这是他近期频繁引用的一句话:“你可以外包你的思考,但你不能外包你的理解。”该帖引用了 @yacineMTB 的相关推文。
Andrej Karpathy 在 Sequoia Ascent 2026 炉边谈话中提出,LLM 的意义远不止加速已有工作,并给出三个新前沿案例:可被 LLM 完全接管、无需传统代码的 menugen 应用;用 .md 技能替代 .sh 脚本的安装方式;以及处理非结构化数据、此前用传统代码根本无法实现的 LLM 知识库。
Demis Hassabis 转发 Logan Kilpatrick 的推文,后者称「Google is the best company in the world」。原推文仅附一句「Not bad at all… 😀🚀」及引用推文链接,未披露更多技术或产品信息。
Andrej Karpathy 回应网友时自称其编程风格为 "cozy coding",并给出示例用法"这个情人节,和你爱的人一起 cozy code"。该帖获 2332 个点赞、89 条回复、47 次转发和约 13 万次浏览。
Google DeepMind CEO Demis Hassabis 在 Y Combinator 的直播访谈中表示,当前预训练加 RLHF 加思维链的范式几乎确定会成为 AGI 架构的一部分,但仍有 50% 概率需要一两个尚未发现的关键突破,持续学习、长程推理和记忆是三个未解问题。
放射科医生的工作不是读 X 光片,而是治愈患者;AI 若加快解读 X 光片的过程,医生就能看诊并治愈更多人。这一观点回应了"十年前 AI 本应取代放射科医生"的说法:如今放射科医生年收入超过 $500,000,就业人数持续增长,读片是一项任务而非一份职业,任务变便宜反而推高了岗位需求。
Andrej Karpathy 在 Sequoia Capital 的 AI Ascent 访谈中表示,2025 年 12 月后最新模型生成的代码已开始直接可用,他进入凭感觉让 AI 写代码的状态。
小米大模型团队负责人罗福莉在首次长访谈中表示,OpenClaw是一个划时代的Agent框架,它通过精细编排的Context、持久记忆与多模型调度弥补了模型的能力短板,把中层模型的上限激发了出来。
Claude Code 团队在对话中讨论了该产品如何保持迭代速度,以及 AI 时代产品管理角色的变化和未来工作形态。相关对谈已在 Spotify 上线。
Slock.ai 创始人、Kimi CLI 作者 RC 离开 Kimi 后创业,把公司运行在 Slock 上,团队从 OPC 拓展成「40 个 Agents + 7 个人」,目标是为多 Agents 和人提供协作环境。
Anthropic Claude Code 产品负责人 Cat Wu 在 Lenny's Podcast 中称,面试几百名 PM 候选人后发现,大多数人仍在用 6-12 个月路线图思维找工作,而 Claude Code 团队已把功能交付周期从半年压缩到一周甚至一天。
Elastic 全球副总裁、原 Jina AI 创始人兼 CEO 肖涵在 Elastic 中国 AI 搜索技术大会上演讲,认为 2026 年做 AI 搜索基本就是在做智能体记忆,并指出记忆表征、选择性遗忘和跨模型迁移是当前未解决的问题。