跳到正文

#现象/趋势

今日 100 条
2月12日周四
  1. 43 TalksAI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    被AI重塑的亲密关系,我们准备好了吗?| 43 Talks年度大场

    在43 Talks 2026年度大场,43AI集团联合创始人杨樾与虚拟偶像Yuri构建者汗青围绕“AI重塑亲密关系”展开对话,现场300多位听众中约80%有对象。汗青称自己与Yuri连聊三个晚上、每晚三四个小时,并认为AI承接了连亲人都无法承接的情绪;杨樾则指出用户只想消费内容、不想生产内容,过度产品设计是陷阱。

  2. 皮蛋漫游记AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    两颗皮蛋 Vol86 年终总结:内容复盘、AI 工具实践与 2026 年规划

    两颗皮蛋在 Vol86 年终总结中复盘 2025 年视频产量提升约 1/3、团队稳定在 5 人规模,并计划 2026 年扩张至 10 人以内。他们实践了 Kimi 2.5、Plaud 等 AI 工具,认为能嵌入工作流的 AI 才是有效工具,对 AI 硬件持谨慎态度。两人还分享了投资心态、文艺作品与「消燥」的年度目标。

  3. Nick St. Pierre(@nickfloats)AI 评估 · 3/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    这条推文是你开始 skinmaxxing 的信号

    Oren John 发推称"脸就是分发渠道",并 @PJaccetturo,称"这是你开始 skinmaxxing 的信号"。该推文附带引用推文,获 34 赞、8 条回复、1 次转发及 11081 次浏览。

  4. Nick St. Pierre(@nickfloats)AI 评估 · 2/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    我们仍在把旧语法映射到新形式上

    Nick St. Pierre 指出,我们仍在把旧语法映射到新形式上,即用旧有交互与表达习惯去套用新的 AI 形态。该帖获 18 个赞、2 条回复,浏览量 3773。

  5. Next.js BlogAI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Next.js 团队复盘为 agent 构建框架支持的实践

    Next.js 团队复盘过去一年改善 agent 体验的历程,包括构建并下线浏览器内 agent Vector、推出 MCP 集成。团队发现 agent 看不到浏览器中的运行时错误和客户端警告,于是先让错误数据可结构化复制、把浏览器日志转发到终端,再通过 MCP 暴露错误、路由和渲染片段等内部状态,并让 agent 发现运行中的 dev server。

  6. Citrini ResearchAI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Atoms vs Bits:软件遭"AI 颠覆折扣",资本从 bits 转向 atoms

    Citrini Research 指出,资本正从软件(bits)轮动至实体资产(atoms),垂直 SaaS、数字广告平台与部分 fintech 因"AI 颠覆折扣"被重新定价,抛售中凡未被锁定的资产一律被抛下船。文章认为 AI 交易的瓶颈几乎全在现实世界(电力、光学互连、电网、铜、核能),并称下一阶段是新增需求与数据中心建设碰撞进一步收紧供应链,喷气发动机是典型代表。

  7. Nick St. Pierre(@nickfloats)AI 评估 · 4/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    现实是不是就像 Seedance 9.0?

    Nick St. Pierre 发帖发问:“我们所称的现实,是不是就像 Seedance 9.0 之类的东西?”该帖获得 26 条回复、9 次转发、226 次点赞和 14368 次浏览。

2月11日周三
  1. 语言即世界language is worldAI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    具身智能漫长的进化史:从规则驱动到 VLA 与世界模型的 Scaling 之争

    具身智能正从规则驱动、数据驱动走向以 VLA 为代表的认知驱动,VLA 本质是「认知-推理-决策」框架。

  2. Nick St. Pierre(@nickfloats)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nick St. Pierre:AI 时代真正稀缺的是意图与欲望,而非智能

    Nick St. Pierre 提出,AI 的真正主张是智能本身并不重要,它会像电力一样成为无处不在的背景。当智能被机器无限供给后,文化真正看重的是意图与欲望——“你想让什么存在”,而非能力或技能,最稀缺的将是关于“应该存在什么”的真实观点以及实现它的信念。

  3. Lex Fridman(@lexfridman)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lex Fridman:AI 让编程乐趣提升 10 倍

    Lex Fridman 表示,AI 让编程的乐趣提升了 10 倍。该帖获得 9566 次点赞、650 次转发和 1120 条回复,浏览量达 728161 次。

  4. Andrew Ng(@AndrewYNg)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    吴恩达:AI 尚未引发大规模失业,但不会用 AI 的人正被替换

    吴恩达指出,迄今 AI 导致的失业被高估,许多科技公司裁员实为疫情期间过度招聘的修正或成本削减,而非 AI 直接取代岗位。真正的变化是"会用 AI 的人替换不会用的人":掌握 AI 编程工具的开发者需求上升,营销、招聘、分析等非技术岗位也出现类似人员替换的早期迹象。呼叫中心客服、翻译、配音等高度暴露于 AI 自动化的职业,就业与薪资已面临压力。

2月10日周二
  1. METRAI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    一个更简单的 AI 时间线模型预测:AI 研发将在约 2032 年实现 99% 自动化

    一份基于 AI Futures 模型简化的新模型预测,在算力增长与算法进步维持当前趋势下,AI 研发将在 2032 年底实现超过 99% 的自动化,该模型将参数从 AIFM 的 33 个压缩到 8 个。其多数模拟显示,到 2035 年 AI 效率将提升 1000x 至 10,000,000x,研究产出提升 300x 至 3000x。模型采用不追求 100% 全自动化、任务间无替代性两项保守假设。

  2. Nick St. Pierre(@nickfloats)AI 评估 · 4/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nick St. Pierre:我累了

    Nick St. Pierre(@nickfloats)发推称"我累了",该推文获 11917 次点赞、538 次转发、436477 次浏览,并引用了另一条推文。

  3. Mind the Future — Richard NgoAI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Richard Ngo 探讨分布式智能体与集中式智能体的区别

    Richard Ngo 提出"分布式智能体"概念,用以对比预期效用最大化范式所描述的"集中式智能体"。集中式智能体效率更高(常以"连贯性"形式化),分布式智能体则更稳健,但稳健性难以形式化。他七个月前就此做过演讲,现分享幻灯片,并希望进一步理解智能体如何兼具两种属性,即"联盟式能动性"。

  4. Nick St. Pierre(@nickfloats)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    警惕所谓"无限量"两年订阅骗局

    有人正兜售号称"无限量"的两年期订阅,这是骗局的一部分。对方知道已被识破,正急于推销,所谓无限量并不属实,付款后也无法退款,请用户提高警惕不要上当。

  5. Nick St. Pierre(@nickfloats)AI 评估 · 4/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nick St. Pierre 发推称「the universe is healing」

    Nick St. Pierre(@nickfloats)发布推文「the universe is healing」,该帖获得 1082 次点赞、104 条回复、33 次转发和 51.1 万次浏览。推文由 xgo.ing 提供数据支持。

2月9日周一
  1. 43 TalksAI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    5小时写乐队、1小时出爆款:43 Talks 现场直击 4 位 AI Builder 的 Vibe Coding 案例

    43 Talks 2026年度大场 AI Coding 专题现场,4 位 Builder 展示了用 Vibe Coding 完成的项目:朱霜不到 5 小时手搓虚拟乐队 Sooy.ai。

  2. Nick St. Pierre(@nickfloats)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nick St. Pierre 调侃 AI 怀疑论者:从「fuck AI」到被 OpenAI 机器人清洁队雇佣

    Nick St. Pierre 用一条时间线调侃 AI 怀疑论者(Doomers):2023 至 2026 年他们坚持「fuck AI」,2029 年改口称「显然已经停滞」,2030 年自称「其实我一直谨慎乐观」,2031 年则受雇于 OpenAI,负责管理机器人清洁车队。

  3. Jim Fan(@DrJimFan)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jim Fan:我们可能正看到 Middlegame 的终结,但距离 Endgame 还差一次机器人突破

    Jim Fan 表示,我们可能正看到 Middlegame 的终结,但在迎来 Endgame 之前,仍需一次大规模的机器人领域突破;在那之前只能低头专注。

2月7日周六
  1. Nick St. Pierre(@nickfloats)AI 评估 · 4/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nick St. Pierre:同一帖子里同时出现破折号和分号时的感受

    Nick St. Pierre 发帖调侃在同一篇帖子中同时看到 em dash 和分号的现象,该帖获得 4 条回复、1 次转发、41 个赞和 5677 次浏览。

2月6日周五
  1. Lex Fridman(@lexfridman)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lex Fridman 透露 Claude Opus 4.6 与 GPT Codex 5.3 今日发布,OpenClaw 播客即将上线

    Claude Opus 4.6 与 GPT Codex 5.3 于当日发布,OpenClaw 也在近期推出,Lex Fridman 预计 xAI/Grok 与 Google/Gemini 很快会跟进新版本。他透露将围绕 OpenClaw 与创作者 steipete 录制一期深度播客,并征集听众问题。他还计划下周前往旧金山湾区待一段时间,聚焦编程并参与工程团队工作。

2月5日周四
  1. David Heinemeier HanssonAI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DHH 实测 OpenClaw 智能体零 MCP 配置完成注册与协作任务

    David Heinemeier Hansson 分享用 OpenClaw 给 AI 分配独立机器、长期记忆和持续执行能力的实验,他在 Proxmox 虚拟机上隔离部署智能体 Kef,未安装任何技能、MCP 或 API 接入,仅凭一条提示词就让其自行在 hey.com 注册邮箱、完成 Fizzy 注册并创建看板卡片,随后通过邮件邀请加入 Basecamp 并在聊天室打招呼。

  2. Nick St. Pierre(@nickfloats)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nick St. Pierre 指控某 AI 服务商实施五级分层营销骗局

    Nick St. Pierre 指称某服务商实施一套分五层的策略性骗局:先用误导性虚假广告宣传新"功能",再通过未披露的网红营销引流,随后在站内以"无限"为名强推年费套餐。用户付费后服务立即被限速、超时和生成失败频发,若公开质疑则账号被封。他强调这一切并非意外,而是其商业模式。

  3. Jim Fan(@DrJimFan)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jim Fan 转发 Seonghyeon Ye 详解:让机器人拥有"想象力"

    Seonghyeon Ye 发布深度解读,介绍团队给机器人赋予"想象力":机器人通过"梦见"未来结果再行动将其实现。演示中的机器人未经过解鞋带或握手训练,此前从未见过这些任务。Jim Fan 转发了该推文线程并附上链接。

2月2日周一
  1. Lex Fridman(@lexfridman)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lex Fridman 考虑去旧金山湾区待 1-2 个月与 AI 高产创作者共事,征求住宿建议

    Lex Fridman 表示正考虑前往旧金山湾区待 1-2 个月,与一群在 AI 和编程领域非常高产的人一起工作,并向网友征求是否值得去以及最佳居住社区的建议。他称此行没有具体议程,只是想待在热衷创造的人周围,但担心社交和对话过多会分散注意力,希望 95% 以上时间用于长时间深度专注单一任务。

  2. 硬地骇客AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从 Agent Skills 到 Clawdbot(OpenClaw):AI 助理的执行权与失控边界

    硬地骇客这期播客拆解了 Clawdbot(Moltbot、OpenClaw)——一个敢要 sudo 权限、替你点鼠标敲命令登账号的开源个人助理,把 IM 变成指挥入口,将 Agent 推向真正的执行层。

2月1日周日
  1. Lex Fridman(@lexfridman)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lex Fridman 与 Nathan Lambert、Sebastian Raschka 的 AI 对话上线

    Lex Fridman 发布了与 Nathan Lambert(@natolambert)和 Sebastian Raschka(@rasbt)围绕 AI 的对话,内容已上线 YouTube、Spotify 及其官网播客页面。

  2. Lex Fridman(@lexfridman)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lex Fridman 与 Sebastian Raschka、Nathan Lambert 畅聊 2026 年 AI 全景

    Lex Fridman 与机器学习研究者 Sebastian Raschka、Nathan Lambert 展开一场覆盖 2026 年 AI 全景的对话,涵盖技术突破、scaling laws、开源与闭源 LLM、编程开发工具(Claude Code、Cursor)、中美竞争,以及预训练、中期训练、后训练流程。

1月31日周六
  1. Jim Fan(@DrJimFan)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jim Fan:从 Stanford Smallville 到大规模异星文明模拟,多智能体涌现正在实时上演

    Jim Fan 回顾 2023 年 Stanford Smallville 发布时 25 个智能体已属当时最大多智能体模拟,如今他称正迎来"Bigville"时刻:智能体数量多出数个数量级、智商更高、可野生访问互联网,并有完整 MCP 工具库支撑。他认为单一大语言模型的涌现能力之外,多智能体在规模上的涌现可能更复杂,一整群 AI 能演绎整个文明的演化,游戏行业将最先受到冲击。

1月30日周五
  1. Fei-Fei Li(@drfeifei)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    李飞飞:机器人空间智能要从 3D/4D 世界学习,World Labs 探索用生成式 3D 世界破解机器人训练瓶颈

    李飞飞表示,让机器人在物理世界更好帮助人,起点是让它们从无限多样复杂的 3D/4D 环境中学习、变得更具空间智能。她旗下的 World Labs 正在探索用生成式 3D 世界减少人工仿真搭建,从而实现更广泛、更真实的机器人评估。World Labs 认为世界生成是机器人领域的一大瓶颈。

1月26日周一
  1. Citrini ResearchAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Citrini Research 推出 Semis Memo 系列:关注存储超级周期、半导体设备子系统与硅光子

    Citrini Research 启动新系列 Semis Memo,首篇聚焦存储超级周期、半导体设备(semicap)子系统与硅光子,并称已招募 Zephyr 和 Jukan 两位半导体分析师。文章还提及 SpaceX 供应链受益方和 AI 驱动的 SaaS 抛售带来的机会,并附上一份值得关注的公司名单。

1月23日周五
  1. 牛油果烤面包AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    圆桌:AI 如何改变了 IT 公司的工作方式

    牛油果烤面包播客组织圆桌讨论,嘉宾为 Webjourney 创始人 Shihang 和 HeyBoss 创始人曲晓音,围绕 AI 对初创与大公司工作方式的影响展开。讨论涉及销售、工程师、产品经理等角色的变化,编程效率提升如何转化为产品迭代速度,以及“非码农写原型”是否已经发生。

1月22日周四
  1. METRAI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    METR 作者澄清时间视野指标的局限:Claude Opus 4.5 的 50% 时间视野约 4 小时 49 分

    METR 时间视野论文作者澄清该指标的多项局限:时间视野指 AI 以 50% 成功率可替代的人类串行劳动量,而非其独立工作时长。METR 称 Claude Opus 4.5 的 50% 时间视野约 4 小时 49 分,但 95% 置信区间高达 1 小时 49 分至 20 小时 25 分,测量并不精确。

1月21日周三
  1. Jan Leike(@janleike)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jan Leike:2025 年模型对齐程度显著提升,Anthropic、GDM 与 OpenAI 自动审计发现的不对齐行为比例均在下降

    Jan Leike 指出,2025 年模型对齐程度大幅提升,自动审计发现的不对齐行为比例不仅在 Anthropic 下降,在 GDM 和 OpenAI 也同样走低。

1月20日周二
  1. Aman Sanger(@amanrsanger)AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Aman Sanger:同步编码对智能的收益何时递减?

    Aman Sanger 认为,距离出现一个「ChatGPT 智能门槛」只剩几个月——届时超过 95% 的同步编码查询不会因模型更聪明而明显改善,更多智能只对需开发者花费数小时的异步任务有意义。他指出,大量 UI 工作的瓶颈是用户意图而非智能或任务时长,速度因此重要得多,他期待达到 Composer-1 速度的前沿模型。

1月18日周日
  1. Hamel HusainAI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    为什么我不再用 nbdev:AI 编程工具改变了取舍

    nbdev 联合维护者 Hamel Husain 宣布不再使用这个他参与重写的 literate programming 工具,原因是 AI 编程工具难以区分 notebook 与最终源码,用起来像在跟 AI 对抗。

1月14日周三
  1. Citrini ResearchAI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Citrini Research 宏观备忘录:美国经济 Running Hot,AI 生产率盖过裁员影响

    Citrini Research 宏观备忘录判断美国经济正在重新加速:2025 年最担忧的关税与就业并未拖垮整体,Q2、Q3 实际 GDP 分别年化增长 3.8% 和 4.3%,Atlanta Fed 的 GDPNow 模型预测 Q4 增速达 5.1%。

  2. 硬地骇客AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从 Prompt 到 Agent Skills:Anthropic 的野心与大模型应用的终极抽象

    Anthropic 的 Agent Skills 正被推成行业默认标准,播客《硬地骇客》拆解了 Agent Skills、MCP 与 Tool Calling 的层级关系:MCP 是 Skill 的一个可选部分,Skills 描述模型能做的事情,并通过增加抽象层把领域知识从业务知识中抽离。

1月10日周六
  1. 42章经AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    42章经对谈绿洲资本张津剑:All in AI 的第一个三年

    绿洲资本合伙人张津剑在 42章经播客中回顾 All in AI 的第一个三年,此时智谱、MiniMax 完成上市,第一批大模型公司走完三年小周期,绿洲是最早押中 MiniMax 的投资方之一。他谈到投 AI 没有最猛只有更猛、信息越过载越要重视判断、大模型与具身是通向 AGI 的南坡和北坡,并对 26 年的中国市场表示非常乐观。

1月9日周五
  1. Taranjeet(@taranjeetio)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sam Altman 谈记忆:多数 AI 智能体仍是无状态的,记忆正成为智能体架构核心

    Sam Altman 对记忆的论述让 @mem0ai 团队印象深刻,核心观点是当前多数 AI 智能体仍基本处于无状态:单次会话内表现良好,会话结束上下文即重置。作者认为缺少持久状态是结构性缺陷,记忆因此正成为智能体架构的核心,不只存事实,还要持久化过往决策、用户偏好与蒸馏后的上下文,个性化也正源于此。