跳到正文

#现象/趋势

今日 102 条
6月10日周三
  1. UX MagazineAI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    研究者变身创造者:AI 时代 21 位 researcher-maker 的经验

    AI 工具正在降低研究者把想法变成产品的门槛,文章采访了 21 位 researcher-maker,记录他们打造背包冻干食品、理财应用、难民社区晚餐等产品的经历。研究者转型创造者的主要障碍不是工具或技能,而是身份认同。成功的关键在于接受"研究者-创造者"的复合身份,并在产品决策中平衡研究直觉与交付节奏。

  2. 枫言枫语AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    枫言枫语 Vol. 169:高考只是个开始,Don't Waste Your Life

    播客「枫言枫语」Vol. 169 围绕高考志愿填报展开,两位主播回顾了自己当年的选择,并讨论 AI 时代下就业变化、AI 与高校教育之间的 Gap 以及该如何学习。节目最后落到好奇心与沟通能力的重要性,并引用乔布斯那句"Don't waste your life"。

  3. Mind the Future — Richard NgoAI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    迈向形式化的科学认识论:Garrabrant 归纳如何取代贝叶斯认识论

    Richard Ngo 提出 Garrabrant 归纳(逻辑归纳)是形式化科学认识论的重要一步,并将其视为贝叶斯认识论的替代方案,而非此前认为的延伸。该机制通过预测市场为逻辑命题定价,市场中的交易者即多项式时间算法,成功者积累更多"wealth",其特征与科学理论相似:多数尚未被纳入考虑、可专注最出人意料的预测、彼此不互斥。

6月9日周二
  1. 枫言枫语AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    枫言枫语 Vol. 168:WWDC26 上的 Siri AI 及格了吗?

    播客「枫言枫语」Vol. 168 复盘 WWDC26,主播自力现场参加 Tim Cook 任内最后一届 WWDC,认为整体内容不算丰富,一半篇幅给了重头戏 Siri AI。节目还聊到 macOS Golden Gate、Liquid Glass 设计优化、新系统性能与安全隐私改进,并指出 Siri AI 如何收费尚不明确。

  2. Epoch AIAI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AGI 之后如何控制资本:UBI、UBS、UBC 与主权财富基金之争

    Epoch AI 发文比较 AGI 后收入再分配方案的核心分歧:是让公民只拿到现金(UBI),还是直接获得资本所有权。文章指出 UBI 让公民仅以投票和税收间接控制资本,主权财富基金(SWF)多一层股东治理权,而全民基本资本(UBC)让公民直接持有股权并按企业迁址收取分红,控制权最强;极端设想"UBC + kill switches"允许公民直接关停所持资本,类比罢工中"关停"自身劳动。

6月8日周一
  1. Citrini ResearchAI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Citrini Research 发布 2026 年 6 月主题投资报告:从 tokenmaxxing 转向 tokenpanic

    Citrini Research 发布 2026 年 6 月《State of the Themes》,指出市场叙事已从 tokenmaxxing 转向 tokenpanic:agent 与更强推理模型推动 token 用量激增,但成本压力随之爆发,Uber 四个月烧完全年 AI 预算、Anthropic ARR 自年初增长 5 倍至 5 月达 450 亿美元。

  2. 开始连接LinkStartAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    锦秋基金复盘 2026 上半年 AI:硅谷大转弯、模型吞噬应用与创业者的真机会

    锦秋基金合伙人臧天宇、郑晓超在播客中复盘 2026 上半年 AI 行业,用「重估」与「世界模型」概括,并梳理三场模型战争:OpenAI vs Anthropic vs Google、视频模型的「GPT-3 时刻」、具身智能的 VLA 与世界模型路线之争。对创业者,核心问题是中国还是美国、以及模型吞噬应用下垂类 AI 的活路。

6月7日周日
  1. Junyang Lin(@JustinLin610)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    人类研究员在 AI 自我改进中的角色是否越来越边缘化?

    针对 AI 递归式自我改进,有观点认为这一方向潜力巨大,但人类研究员在其中似乎越来越不重要,令人沮丧。该观点同时指出,人类监督将变得更加有原则、更高层级,届时想象力与愿景比以往任何时候都更重要。

6月5日周五
  1. Richard Socher(@RichardSocher)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Richard Socher:一个领域的顶尖聪明人,在其他领域也可能做出错误预测

    Richard Socher 指出,在一个领域极为聪明且卓有成就的人,在其他领域可能做出非常错误的预测,并以 1931 年一篇关于爱因斯坦的文章为例,认为当下也有不少人如此。他认为恐惧是对变化的自然反应,媒体偏向放大这种恐惧,因为更具娱乐性、更能带来互动。

  2. Alex Albert(@alexalbert__)AI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 内部数据:超 80% 合并代码由 Claude 编写

    Anthropic 公布内部数据:超过 80% 合并进代码库的代码由 Claude 编写,许多 Anthropic 研究员已有数月不再手写代码;工程师平均代码交付量达到 2024 年的 8 倍。

    为什么值得看

    Anthropic 内部数据显示编码自动化程度已很高,读者可借此了解 AI 研发自我加速的当前进展。

6月4日周四
  1. 开始连接LinkStartAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    谷歌还在追赶 OpenAI 和 Anthropic?这是 Google I/O 2026 最大的误读

    谷歌在 Google I/O 2026 上缺席 Gemini 3.5 Pro、未更新 Veo,被外界视为遗憾,但极客公园播客邀请亲赴现场的 Bryan Liu 与作者 Alan 解读这场发布会背后的野心。节目指出谷歌把模型分成「干活的」和「思考的」,并借 Gemini Spark、Gemini 重写操作系统及谷歌眼镜,展现将讲故事权利还给所有人、成为用户「外置大脑」的方向。

6月3日周三
  1. 牛油果烤面包AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何从零到一做风投:两位工程师转型 VC 的实战分享

    播客「牛油果烤面包」第 150 期邀请两位从软件工程师转型为 VC 基金管理人的嘉宾 Cindy 和 Tao,分享从大厂码农到一级市场投资人的转型路径,包括启动资金、第一批 LP 的寻找方式与拿到好项目份额的挑战。他们还从 VC 视角拆解了当下 AI 泡沫的结构性问题,并与 2000 年互联网泡沫作对比,同时给码农和小投资者提供参与这轮 AI 浪潮的实用建议。

6月2日周二
  1. Martin Fowler(@martinfowler)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Martin Fowler 谈 AI 使用指标失真、闭源与开源模型基准测试等话题

    Martin Fowler 在新一期 Fragments 中讨论了 AI 使用指标不可靠、技术取代工作的历史、闭源与开源模型的基准测试对比、LLM 会放大既有代码腐化、AI 垃圾内容令人不堪其扰,以及"我是智能体的全局解释器锁"等话题。

  2. UX MagazineAI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Gamification 2.0 第四章:专为玩家而非指标设计,还需考虑哪些特殊问题

    面向 Gen Z 和 Gen Alpha 的教育类游戏化产品正被年轻用户识破,一个十二岁玩家直言"这不是游戏,只是带积分的作业"。文章指出教育游戏化失败源于三点:设计者本身不是玩家、把学生当低龄儿童、缺乏真正的自主性与挑战。Minecraft Education Edition、Kerbal Space Program 和 Duolingo 的有效之处在于本身是真正的游戏。

  3. Richard Socher(@RichardSocher)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Richard Socher:AI 仍需更好的数据,金融智能体在竞争性基准上大幅跃升

    Richard Socher 指出,AI 仍需要更好的数据才能给出更复杂的答案,金融智能体尤为如此。他提到团队合作打造了一款基于 Deep Agents、LangSmith 和 you.com Finance Research API 的宏观经济研究智能体,能分析 GDP 数据、检测异常并输出带引用的结构化简报。Socher 称在一个多家竞争对手也公布结果的竞争性基准上,很少见到如此大幅的提升。

6月1日周一
  1. Andrew Ng(@AndrewYNg)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    吴恩达谈 AI Forward Deployed Engineer:FDE 岗位复兴,但 AI Engineer 需求更大

    OpenAI 和 Anthropic 开始组建团队、把 AI Forward Deployed Engineer(FDE)派驻到客户组织内,推动这一岗位在硅谷复兴。FDE 需兼具技术、沟通乃至业务能力,负责把现成 LLM 定制成贴合客户需求的智能体工作流。吴恩达认为 AI Engineer 的岗位数量将远超 FDE,因为企业更愿意让自家员工做项目,且厂商中立的 FDE 难以寻找。

  2. 乱翻书AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    3000块成本、3.5亿次播放,AI短剧《安徽小木匠》怎么在抖音挣钱

    AI短剧《安徽小木匠》作者小果哥哥在播客中复盘,该剧制作成本不到3000元,播放量超过3.5亿次,收益50多万元。他介绍了从番茄小说选IP、用AI生成并拼接剧本、小云雀生成视频、重新拼接音画到抖音和红果上线分发的完整流程,并提到上线受益还涉及投流,从学习AI到剧集上线共19天。

  3. Import AI — Jack ClarkAI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Import AI 459:AI 监管之难、蛋白质折叠模型的缩放定律、AI 系统灭绝风险的定价

    Import AI 459 聚焦三项研究:弗吉尼亚大学、Anthropic 与加拿大银行的经济学家测算美国 AI 经济名义规模 2025 年约 2500 亿美元。

  4. David Heinemeier HanssonAI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    让 AI 智能体推动开源民主化

    DHH 发文批评开源社区针对 AI 辅助贡献设置参与门槛的"反智能体"潮流,认为这是在用质量、署名、劳动者权益等借口维护旧程序员行会的特权。他指出 AI 智能体虽不完美、slop 确实是问题,但让更多人获得改写软件的能力,正是开源最初愿景的兑现。

  5. Adam D'Angelo(@adamdangelo)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Adam D'Angelo:AI 编程让「现地现物」在软件业变得可行

    Adam D'Angelo 借用丰田精益制造的「genchi genbutsu」概念指出,AI 编程让管理者得以直接查看真实代码,而非听二手汇报。他引用 Guillermo Rauch 的说法称,CEO 和 CTO 正因 coding agents 重新开始写代码,有人靠 Claude Code 和 Vercel 重新爱上交付软件。

5月31日周日
  1. 42章经AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    一个 AI 创始人的虚荣心、装,和愚昧之巅

    AI 创业者梦琪复盘一年历程:从字节背景的梦幻团队、讲 RL 故事融资,到做垂直 Sourcing Agent 后发现垂类 Agent 有结构性困局——被迫变成 agency,且 toB 在中国和海外华人都很难做。她认为大部分纯应用创业公司不该招算法,创业初期的高光都是"愚昧之巅"。转型 toC 后做出浏览器插件 tryclico,已迭代到第 49 版,认为这代产品 70% 精力要花在交互上。

5月29日周五
  1. 乱翻书AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    乱翻书对话字节前增长中台Tom:字节跳动如何做增长

    乱翻书对话2019年加入字节、在增长中台负责国际化业务的Tom,复盘字节增长十年。Tom称在其负责TikTok增长的一年多里,TikTok涨了四五亿DAU,节目梳理了从预测LTV模型、自动化投放、素材工业化到风控体系的中台搭建过程,并谈及头条、抖音、TikTok的多个关键战役,最后讨论豆包和AI时代这套方法论是否还成立。

  2. Epoch AIAI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Epoch AI:开源模型落后最先进闭源模型约 4 个月

    Epoch AI 基于其自研能力指标 Epoch Capability Index(ECI)测算,开源权重模型追上最先进闭源模型性能平均需约 4 个月,ECI 综合了多个 benchmark 的表现。相关数据以 CSV 形式提供下载,更新于 2026 年 5 月 29 日。

5月28日周四
  1. 枫言枫语AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    枫言枫语 Vol. 167:Token 如流水,Agent 似朝阳

    播客《枫言枫语》第 167 期盘点近期科技新闻:OpenAI 与微软终止独家合作,Anthropic 的 Project Glasswing 发现大量高危漏洞,企业面临大模型 Token 成本压力。

  2. Martin Fowler(@martinfowler)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Martin Fowler 碎片集:与 Kent Beck 的 GOTO 对谈、用 AI 重构复杂代码库、开源与安全等

    Martin Fowler 发布 Fragments 合集,收录与 Kent Beck 的 GOTO 对谈,以及用 AI 辅助重构复杂代码库的实践讨论。合集中的其他话题涵盖开源与安全、认知耐力、AI 时代的 Z 世代未来、AI 对就业的影响,以及对 AI 监管的摸索。

5月27日周三
  1. 张小珺Jùn|商业访谈录AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    雨森的创投观察第2集:Harness、下一个字节、2026大机会和 Stanley Druckenmiller

    真格基金管理合伙人戴雨森在《雨森的创投观察》第2集回应第1集"被打脸"往事,提出"AGI是在缩水的"和"字节系创始人要把在字节学的东西自己颠覆自己"两个暴论。他认为Harness更像OS、模型更像处理器,Manus、Claude Code、OpenClaw、Codex、Hermes是用户喜欢的Coding Agent Harness。

5月26日周二
  1. Import AI — Jack ClarkAI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Import AI 458:直面 AI 的未来,以及一个奇点故事

    Jack Clark 在 Import AI 458 中发布一篇长文,基于其在牛津大学 HAI Lab 所做的 2026 Cosmos 讲座,提出面对 AI 持续进步只有两种选择:探索未来,或从当下退缩。他认为 AI 不是普通技术,能力增长速度可能远超预期,并给出一个判断:AI 可能即将能自行开发继任者,从而启动递归自我改进。

  2. Last Week in AIAI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LWiAI Podcast #246:Gemini 3.5 与 Omni、Musk 败诉、OpenAI 对阵 Erdős 问题

    Google I/O 发布 Gemini 3.5(重点推 3.5 Flash 的速度与基准成绩)、常驻智能体 Gemini Spark 和视频生成编辑模型 Gemini Omni。

5月25日周一
  1. 枫言枫语AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    枫言枫语 Vol. 166 闲聊:从 Gemini 到 AI 的加速与混沌

    播客「枫言枫语」Vol. 166 从近况和 Gemini 新模型聊起,讨论 AI 的加速与随之而来的行业混沌。两位主播认为今年 AI 发展速度是去年的 3-4 倍,并谈到 Superpowers 使用心得、用 AI 做墨水屏问答小游戏、将微信小游戏移植到 iOS,以及 Token 成本有时甚至高于人工。

  2. Epoch AIAI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Epoch AI:算力短缺要来了吗?

    Epoch AI 测算,以 Kimi K2.6 类模型在 Q4 2025 全部 Nvidia GB200 与 GB300 上的推理能力,可提供 5 亿至 200 亿 output tokens/秒,取决于请求上下文长度(8,000 / 25,000 / 128,000 输入 token)。

5月23日周六
  1. 宝玉的分享AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek 的 10 万亿美元大战略

    DeepSeek 正以极致压缩 KV 缓存换取硬件自主:据测算,1.6T 参数的 DeepSeek V4 在 100 万上下文、8-bit KV 精度下只需 5.48 GB HBM,而 GLM5 需 60 GB、Qwen3-235B-A22B 需 89 GB。

5月21日周四
  1. UX MagazineAI 评估 · 14/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    让不可见变得可见:深入探索 AI 的 6 个月

    一位产品人在过去 6 个月没有跟风做 vibe coding 或写完美提示词,而是研读学术研究、做笔记,把理论转化为可落地的框架和原则,帮产品团队设计合适的信任、采用、聊天机器人与提示词。她提出用"认知强制"式的确认步骤应对用户自动化偏见,并强调同一个 AI 体验不会适合所有用户,关键在上下文与有意图的设计。

  2. 罗永浩的十字路口AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    郑执×罗永浩:从小说家到导演,聊聊《森中有林》与东北文学

    郑执首次自编自导的电影《森中有林》近日院线上映,由于和伟、高圆圆、韩庚等主演,并在第16届北京国际电影节主竞赛单元“天坛奖”斩获两项重要奖项。本期《罗永浩的十字路口》从这部电影聊起,谈及他从小说家到导演的转变,以及他自嘲永远在“追赶末班车”的人生际遇。

  3. Kevin Weil 🇺🇸(@kevinweil)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 与数学的又一项首创

    数学家 Timothy Gowers 分享了一项 AI 与数学交叉领域的新进展,并称同行看到内容前最好先坐下。该帖被描述为"AI 与数学一系列首创中的下一项",但正文未透露具体成果内容。

5月20日周三
  1. Martin Fowler(@martinfowler)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Birgitta Böckeler 探索静态代码分析的三种"传感器":结果喜忧参半

    Birgitta Böckeler 在 martinfowler.com 发文,探索静态代码分析的三种"传感器",结果喜忧参半。仅靠计算型传感器作用有限,需要 AI 补充语义解释,并需权衡取舍。

  2. UX MagazineAI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Brian Evergreen:真正的 AI 战略不是供应商选型比拼

    The Future Solving Company 创始人 Brian Evergreen 在 Invisible Machines 播客中指出,智能体 AI 奖励"愿景优先"的战略,而企业惯用的 RFP、分析师象限和功能对比矩阵只适用于问题已变成标准 SKU 的场景——当工作本质是探索时便会失效。

  3. Last Week in AIAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LWiAI Podcast #245:TML-Interaction、Claude For Legal、Sam Altman 出庭作证

    OpenAI 在 API 中上线 GPT Realtime 2(由 GPT-5 驱动)等语音智能功能,并加入实时翻译与 Whisper 转写;Thinking Machines 预览了双模型架构的低延迟全双工对话系统,但尚未开放公测。

5月17日周日
  1. 宝玉的分享AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    为什么我不"凭感觉编程"

    资深开发者 Jacob Harris 撰文解释自己为何拒绝"凭感觉编程"(Vibe Coding)。他因不愿为 Token 持续付费而卸载集成 LLM 的 IDE、回归 Emacs,并认为 LLM 只能解决编写代码本身的"偶然复杂性",无法应对架构设计等"本质复杂性",且无法解释自身选择的路径。

5月16日周六
  1. 42章经AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    当软件容易被创作,新时代的产品长什么样?| 对谈 Albert

    连续创业者 Albert 在两个月内带团队试做了几十个新产品,均未达其发布标准,直到推出 merging.live,核心是为新的 maker 群体提供「回响」。他认为 Opus 4.6 之后模型厂商正加速挤压创业空间,但智能并非最高层的价值,因此不能围绕普遍性做产品。

  2. Ahead of AI — Sebastian RaschkaAI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LLM 架构新动向:KV 共享、mHC 与压缩注意力

    Sebastian Raschka 梳理近期开源权重模型的架构改动,指出长上下文效率成为设计重心。文章拆解 Gemma 4 的跨层 KV 共享与逐层嵌入、Laguna XS.2 的逐层注意力预算、ZAYA1-8B 的压缩卷积注意力,以及 DeepSeek V4 的 mHC 与 CSA/HCA 压缩注意力。