从蒸馏到合成数据到 RSI,模型竞争的下一个焦点是什么?|42章经
前 Kimi 研究员、Evolvent AI 联创繁青认为,国内模型与国外差距缩小主要靠预训练架构创新,如 Kimi Linear 和 DeepSeek 的 Multi-head Latent Attention,蒸馏只是补后训练数据积淀不足的手段。
前 Kimi 研究员、Evolvent AI 联创繁青认为,国内模型与国外差距缩小主要靠预训练架构创新,如 Kimi Linear 和 DeepSeek 的 Multi-head Latent Attention,蒸馏只是补后训练数据积淀不足的手段。
Yann LeCun 转发了一条调侃欧美生育差异的推文,配文"Only in America. Tired of winning?"。被转发内容是用户 Reginald(@ginald87)发布的"Giving birth in Europe vs in America"对比视频。该帖获得 757 次点赞、85 条回复和 36 次转发。
Yann LeCun 重申其坚持约 10 年的主张:AI 技术唯有广泛可用、共享且开放才有出路,且只有开放基础模型才能支撑语言、价值观与专业知识各异的多元 AI 系统。他援引 Mark Zuckerberg 近日文章,称"AI 太危险、只能靠极端权力集中"的观点本身就有问题,并指 Dario Amodei 所反驳的"以多个 AI 系统间的权力平衡相互制衡"一说正是指他本人。
科技数码频道热男 HotGuys 的两位联合创始人崔野和尹国威在播客中拆解了《国行顶配 3》从创意、分镜、踩点到后期审片的完整流程,并回顾了六位合伙人带着半年房租出来创业的经历。面对 AI 开始生成视频、小剧场不再稀缺,热男表示只要还能覆盖成本就一直做下去,让人开心仍然有价值。
枫言枫语最新一期播客讨论两位主播沉迷 AI 编程后人类反而成为开发循环瓶颈的现状,提到 Tibo 频繁给 Codex reset、Anthropic 给 Fable 5 解禁,两家 frontier model 的 $200 plan 都嫌 token 不够用。
Dario Amodei 不认同自己的 AI 表态过度负面,称风险与收益各写过一篇长文,并常在访谈中提及收益与解决方案。他表示撰写《Machines of Loving Grace》是为反驳对 AI 健康与生物潜力的怀疑,认为约 5-10 年内有望治愈大多数人类疾病。他将公众对 AI 的负面看法归因于信任危机,而非 AI 领袖的风险警告。
Dario Amodei 回应 Gavin 称,"把 AI 监管等同于监管俘获和权力集中"是伪二选一。他以加州 SB53 为例,指出该法案对营收或模型训练成本低于 5 亿美元的公司完全豁免,Anthropic 主张对前沿模型施加比非前沿模型更严格的测试。
开发者 Agent 框架仍处早期阶段,Vercel 的 eve 与 Cloudflare 的 Flue 均于今年推出,初步确立了模板。Flue 作者 Fred K. Schott(也是 web 框架 Astro 的作者)解释了智能体为何需要 harness,以及 React 如何影响 Flue 2。
Naval 发帖称"你不能创造上帝再给他拴上绳子",该帖获得 16538 次点赞、1446 次转发和 917 万次浏览。
OpenAI、Anthropic、Grok 均已上线"录屏即技能"功能,可自动读写邮件、综合数据并给出结论,如今还能登录专业软件替你执行任务,每月花费 20-200 美元。作者称,只需一两天调好工作流,之后便可放手,低到中级远程岗位的工作几乎 100% 可被自动化。
一条面向 @creatine_cycle、@willcb 和 @swyx 的推文调侃称"it's provocative, it gets the people going",即这话足够挑衅、能让人群起劲。该帖获得 1 条回复、1 次转发、6 个赞和 1728 次浏览,由 xgo.ing 提供支持。
Z.ai 发布 GLM-5.3,目前仅在编码套餐中提供,之后将上线 API,两周后登陆 Hugging Face 开放权重。
以 Z.ai 被称为仅靠后训练扩展的小参数模型为切口,拆解中国实验室贴近前沿的发布节奏与数据产业因素。
围绕AI办公赛道的竞争逻辑,节目讨论了大厂争夺的真实标的:从Claude Tag被卡帕西盛赞、海外极客弃用代码客户端,到WorkBuddy以免费额度抢用户,再到单任务成本与云巨头底牌的拆解。飞书并入豆包、Gemini 3.5 Pro难产被归因于卖算力更赚钱,而没有云底座的OpenAI与Anthropic被认为只能继续讲故事。
Dify 亚太区总经理陈璐莎在 Zenlayer 发起的访谈中,围绕 Agentic AI 分享了企业从 POC 走向生产级落地的观察,指出真正需要补齐的不只是模型能力,还包括工作流、数据基础与组织准备。
METR 发布分析,对比漏洞发现、数学成果和算法优化三类公开数据,寻找 AI 带来的增速拐点。漏洞发现增速最明显:cURL 漏洞从 2025 年 9 个增至 2026 年 6 月 24 日的 36 个,其中 15 个标注 AI 参与;OpenSSL 从 6 个增至 39 个;Firefox 从 210 个增至 342 个。
Epoch AI 发文列出关于 AI 能力的 9 个大问题,涵盖 AI 能否胜任完整工作、网络安全与电脑操作等下一个能力拐点、前沿与追赶模型差距、AI 能否做 AI 研发、能否在部署中即时学习,以及经济影响等,并用 Andon Café、Remote Labor Index、EBR-bench 等基准测试跟踪进展。
Jeff Dean 在 X 上回复 Zachary Lipton,写道"That's a pretty penne"。该帖获 535 次点赞、4 次转发、9 条回复,浏览量 33492。
Ouraca 两位联合创始人张栖铭与吴俊东复盘一年多创业踩坑:全员用 AI 后流程没变、只是旧流程被加速,真正耗时的开会对齐一分钟没省,AI 写的「先变小再播放」这类隐藏坏逻辑还让团队间歇性想退回古法编程。他们改按上下文而非职能分工、全员出原型、把公司长在 GitHub 上,会压缩到每天十分钟站会,并称一周能写十几万行代码。
Mem0 正在构建独立的记忆层,认为记忆不该是一个塞满旧对话的巨型提示词,而应拥有自己的层。该帖将其称为真正的调试界面(debugging surface)。
Ouraca 联合创始人张栖铭和吴俊东复盘一年多的 AI 提效踩坑:每个节点都在用 AI,版本却没快多少,因为真正写代码的时间本来就不长,大头是开会、评审、对齐,这些一分钟都没省。
昆山杜克大学教授周忆粟指出,AI 把学习所需的"摩擦"填平,junior 往上流动的梯子被抽掉——有统计显示美国科技行业 22-25 岁工作机会减少 25%,40 岁以上反而增加 18%。他观察到大学考核正转向具身性、当场检验和面向过程,而大学真正卖的是把聪明孩子放在一起的回音室。他本人充值 max 会员后,agent 曾用 10 小时干完积压多年的数据收集活。
英伟达研究副总裁刘洺堉透露,其领导的唯一项目世界基座模型 Cosmos 已发布至第 3 代,直属团队不到 100 人,虚线汇报规模 200 至 300 人,黄仁勋要求他"做到 Cosmos 97"。他表示英伟达不做存量竞争,目标是像 CUDA 一样造出 Physical AI 这一新市场,因此坚持开源模型帮助具身智能领域分担压力。
英伟达研究副总裁刘洺堉在4小时访谈中谈及他领导的世界基座模型Cosmos项目,该项目2024年立项,已迭代至Cosmos 3,直属团队不到100人,虚线汇报规模200至300人。身为英伟达首位由研究员晋升的副总裁,他强调英伟达不参与存量竞争,主张"造市场"而非击败对手,黄仁勋曾对他说"你就做到Cosmos 97"。
李继刚(@lijigang_com)发布了一条推文,获得 15 个点赞、2 条回复、1 次转发和 6 次收藏,浏览量达 12055 次。
Kling AI 预告一只“海盗猫”视频正在全球走红,完整视频将于明天发布。相关推文已获得 217324 次浏览、86 个点赞。
Lex Fridman 发布了某内容的俄语版本,并在推文中附上视频播放提示,提醒浏览器不支持 video 标签。该推文获得 36 条回复、41 次转发、255 次点赞和 82169 次浏览。
Interconnects AI 作者 Nathan Lambert 完成了一本关于 RLHF 的后训练教科书《Reinforcement Learning from Human Feedback》,写作中借助 LLM 处理 LaTeX 公式、大量 copyediting 和 TikZ/Python 图表。
这期播客从神经科学角度讨论长期使用 AI 工具对学习和记忆的影响。节目引用 MIT Media Lab 研究称,长期用 AI 写作的年轻人脑电活动偏低,研究者将依赖 AI 后大脑激活减弱、记忆下降的现象称为认知债务;同一实验里,用 ChatGPT 写 SAT 作文的一组神经耦合度最低,且难以复述自己写的句子,4 个月后换回手写大脑活性依然偏低。
Mistral 正在构建一个框架,让企业、政府和初创公司都能用上最好的 AI,围绕自身知识对其进行塑造,并保留其创造的价值。该框架是 Mistral 的发展方向。
Mistral AI 表示世界需要一个开源平台,其正在构建该平台,让客户能按任务选择合适模型,并拥有更多选择与灵活性。作为其中一环,Mistral AI 将继续跨模态创新前沿、高效的开源模型。
Jeff Dean 公开了自己的每周运动计划:25 岁以上联赛足球 2 场、健身房 2 次、瑜伽 2 次,每周跑步通勤 3-4 趟、骑行通勤 3-4 趟,单程各 8k,周末再加一次长跑或长距离骑行。
Jeff Dean 发布一页由多个部件拼合而成的幻灯片,中间部分包含更多图片与上下文信息。该帖获得 8 条回复、14 次转发、80 次点赞,浏览量 27294。
林俊旸公开致谢过去几个月里伸出援手的老朋友和新朋友。该帖未透露具体致谢对象及事由,仅表达感谢。
一位研究者因朋友推荐语用学而学习语言学,后转向计算语言学和 NLP,认为这一名称意味着回到问题发生之处,也指向实用主义(pragmaticism),并主张 AGI 应以实用主义为目标。
Rowan Cheung 在 X 上发布了完整访谈的视频链接,指向 YouTube 上的一期访谈节目。推文未附文字说明访谈主题或受访对象。
艾语智能创始人张天乐在播客中讲述公司用AI每月从中国3000个法院批量提起1到2万件小额信贷诉讼,回款率高于传统律师,做法是立案后陪客户分期一至三年而非打电话施压。
Martin Fowler 提出疑问:让编程智能体自行执行 TDD 是否真的有效,还是属于"对人类有益、对智能体却无益甚至有害"的罕见情形。Birgitta Böckeler 对此开展实验并在 martinfowler.com 分享了她的思考。
少数派创始人老麦在播客《三五环》中回顾从 Palm、WebOS 时代的 BBS「煮机网」,到创立少数派并跑通「内容+产品」商业闭环的二十年历程。他提到 WebOS 被惠普放弃后曾组织用户为开发者捐款,后因与罗永浩「不打不相识」的转折关闭煮机网。面向 AI 时代,他认为 AI 眼镜、录音戒指等专用设备将分担手机功能,语音交互与第一人称视角记录会成为个人助手的新入口。
Richard Socher 指出,一则旨在煽动 AI 恐慌的信息是愚蠢的虚假信息典型案例。该帖未披露具体信息内容与来源,仅强调其为不实信息。
Logan Kilpatrick 发帖呼吁"increase your lever of ambition",该帖获得 1636 次点赞、223 条回复、72 次转发、107701 次浏览。