跳到正文

全部动态

今日 0 条
8月22日周六
  1. Andrew Ng(@AndrewYNg)AI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    构建与部署 AI 应用最重要的技能

    吴恩达(Andrew Ng)分享了构建与部署 AI 应用所需的最重要技能,相关长文发布在其 X 账号文章中,该推文获得 260 条回复、2076 次转发和 12131 次点赞。

  2. Yann LeCun(@ylecun)AI 评估 · 4/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun 回复 @ziv_ravid:No

    Yann LeCun 在 X 上回复 @ziv_ravid,仅以「No」作答,未展开任何说明。该条回复获得 214 次点赞、9 条回复、7 次转发,浏览量达 22162。

8月21日周五
  1. DeepLearning.AI(@DeepLearningAI)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    吴恩达列出 AI 应用开发者必备的七项基础技能

    吴恩达列出的 AI 应用开发者必备技能包括:LLM 基础、用数据为模型提供依据、构建智能体系统、评测驱动开发、生产环境运维、机器学习基础。这是 AI Engineering Skills Map 的第二期内容。

  2. DeepLearning.AI(@DeepLearningAI)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    吴恩达列出 AI 开发者必备的七项核心技能

    吴恩达给出 AI 应用开发者的七项基础技能清单:LLM 基础、用数据为模型提供事实依据、构建智能体系统、评估驱动开发、生产环境运维,以及机器学习基础。这是 AI Engineering Skills Map 的第二期内容。

  3. Stack Overflow BlogAI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    O'Reilly 观察:智能体开发需要多少规格说明才合适

    面向智能体的开发中,零规格的"氛围编程"并不省钱,纠正循环会把成本推给人类审查者;而完整形式化规格前期代价高,却让更多验收标准变成可执行测试。多智能体场景下,一个智能体的误解会被下一层当作事实继续放大,此时规格更接近契约,需要 schema、不变量、验证规则和契约测试。作者建议在实现前用智能体先做规格校验,找出矛盾、不可测主张与缺失的失败模式。

  4. Naval(@naval)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Naval:前沿实验室有动机渲染恐惧,为闭源提供道德正当性

    Naval 认为前沿实验室有动机渲染恐惧,因为恐惧能为闭源路线提供道德正当性,而中国实验室则一致采取开源、对所有人有利的立场。这让小玩家陷入不得不支持中国实验室的尴尬处境。

  5. 知行小酒馆AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从 QQ 空间到苹果设计大奖:专访 CapWords 创作者 Ace 的非典型设计师之路

    语言学习产品 CapWords 获 2025 Apple 设计大奖,成为中国第一款拿下该奖项的非游戏类 iOS App,且上线仅三四个月。创作者 Ace 从未接受正规设计教育、不会画画,设计之路起步于网吧里通宵研究 QQ 空间装修。他认为 AI 提升了产出效率,却让做产品变得更「慢」、门槛更高。

  6. 东腔西调AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    孟庆延:我们对AI感到恐惧,是因为自己太像一个低效的AI

    中国政法大学教授孟庆延在播客「东腔西调」中提出,人们恐惧AI,是因为过去的自己太像一个低效的AI——现代社会只追求要点,人先把自己活成了AI。他从今年8月《华东师范大学学报(教育科学版)》集中发表5篇AI与人类共同创作、AI为第一作者的论文谈起,认为人机合作论文水平已超越人类写作平均水平,与真人打交道、依赖身体感知的具身性工作更难被AI取代。

  7. 乱翻书AI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    伪史论为何今年大爆发?河森堡、宋方金聊「唐朝不存在」

    播客「乱翻书」请来科普作家河森堡、编剧宋方金等,讨论伪史论今年在网上大爆发的原因:短视频把所有人放进同一个场,最极端的声音走得最远。节目从伪史论的三段病程谈起,提及「唐朝不存在」等说法,并指出伪史论从西方传入、俄国人福缅科是祖师爷。

  8. What's Next|科技早知道AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    宇树上市暴涨,但人形机器人的钱到底从哪里赚?|S10E26

    宇树科技 2026 年 8 月 19 日登陆科创板,首日盘中最高市值超 4400 亿元,较发行价上涨六倍多,收盘仍有 3400 多亿元,同期机器人板块指数却下跌近 8%。二级市场投资人周玖洲从投资与商业逻辑拆解宇树上市,讨论其千亿市值是否成为机器人赛道的「估值锚」、人形形态是否通向商业化,以及科研教育、商演、导览等场景的真实需求能否支撑复购和商业闭环。

  9. Stack Overflow BlogAI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    WordPress VIP CTO 谈 AI 智能体如何改变 Web 商业模式:告别 CAPTCHA

    WordPress VIP CTO Brian Alvey 在 Stack Overflow 播客中讨论 AI 智能体如何改变 Web 商业模式,以及当前建站方式中哪些部分将在数字化演进中被淘汰。他强调网站始终需要结构化内容,并指出 CAPTCHA 这类人机验证机制正面临被智能体取代的未来。

  10. Naval(@naval)AI 评估 · 0/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Naval:不朽、意义与爱就在身边,只是伪装成了孩子

    Naval 表示,不朽、意义与爱其实触手可及,它们只是以孩子的模样在人们身边奔跑。这条发布于 X 的推文获得 14676 次点赞、1504 次转发和 723542 次浏览。

  11. 阮一峰的网络日志AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    科技爱好者周刊(第 409 期):程序员的职业未来

    阮一峰在第 409 期周刊中援引一位业内人士的预测:编码代理将长期存在、不会消失,并已永久成为软件开发流程的一部分,公司管理层会持续施压程序员尽可能多地使用它。

  12. Stack Overflow BlogAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 不会取代项目经理,但正在重塑工作的完成方式

    生成式 AI、LLM 与智能体工作流正被整合进工程交付流程,让技术项目经理从事务性协调转向"AI 增强的系统架构师"。文章给出的数据是:状态跟踪耗时占比从 25% 降至 8%,风险管理从 15% 降至 5%,资源分配从 10% 降至 5%,而战略规划从 10% 升至 25%,相关方对齐从 8% 升至 18%。

  13. bolt.new(@boltdotnew)AI 评估 · 0/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    bolt.new 分享用户 Paul 的故事

    bolt.new 在社交平台分享了一位名为 Paul 的用户故事,并附上 bolt.fyi 的短链接供读者阅读。帖文未披露故事的具体内容与细节。

  14. Naval(@naval)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok Bot 智能体:持久化运行、拥有自己的电脑

    xAI 的 Grok Bot 被称为"很酷",其智能体具备持久化运行能力并拥有独立计算机,原文认为智能体本就该如此。这条帖子还提到下一步只差"具身化",互动数据显示浏览量达 3279307。

8月20日周四
  1. Jim Fan(@DrJimFan)AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jim Fan 解读 GEN-1.5 走红:关键在人类数据中的重复性动作与 UMI

    Jim Fan 认为 GEN-1.5 的走红名副其实,其秘密在于人类采集数据中天然存在的重复性动作:对称模式(如拧完一颗螺栓再拧对称那颗,第二遍就是免费的训练信号)与恢复动作(把失败的前半段保留下来,而非剪掉,让模型完整经历失误、补救、继续)。

  2. 人民公园说AIAI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek Harness:Agent 工厂来了,但你的企业配用吗?

    DeepSeek Harness 被比作"造车工厂"而非 Codex 那样的"整车厂",主打可插拔的 Agent 生产架构。节目讨论其插件机制 Cordis 能否真正做到插拔自由,并质疑多数企业尚不具备 AI 原生工作流的落地条件,认为架构先进不等于能落地。

  3. 海外独角兽AI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek Harness 发布:一套可热重载、可由 coding agent 自行修改的 Agent Harness

    DeepSeek Harness(DSH)发布了一套可热重载的 harness,设计成适合 coding agent 自己修改和进化的形态,以本地 Web UI 为主要入口,并提供标准、PTC/Code、极简、创造四个模式。

    为什么值得看

    梳理 DeepSeek Harness 的插件化三层结构与 Creator 模式,读者可对照 Anthropic 路线理解两种 harness 设计取舍。

  4. Logan Kilpatrick(@OfficialLoganK)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI token 支出中有多少用于跑评测?

    Logan Kilpatrick 在 X 上发问:全球 AI token 支出中,用于跑 evals 的比例能占多少?该帖获 1093 次点赞、209265 次浏览,并附有 xgo.ing 投票互动。

  5. 硅谷101AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    硅谷101 E249:从 Token Maxing 到 OpenClaw、Hermes,Agent 进化与本地开源模型经济账

    硅谷101 这期播客讨论 Token Maxing 热潮的转折:Uber 四个月烧穿全年 AI 预算,Meta 给员工设 token 上限,嘉宾黄东旭从每天烧三四百美元转向本地开源模型底座加前沿模型的搭配,日常任务每天电费约 1 美元。

  6. Naval(@naval)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Naval:未来所有 UI 都是聊天与手势输入、聊天与视频输出

    Naval 预测,最终所有 UI 都会变成"聊天和手势输入、聊天和视频输出"。该帖获 6975 次点赞、320 次转发和 55.18 万次浏览。

  7. Martin Fowler(@martinfowler)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Martin Fowler:公民构建、智能体执行、专家治理——周末做个应用为何不等于做企业级软件

    Martin Fowler 撰文提出"公民构建、智能体执行、专家治理"的分工框架,指出周末用 AI 快速搭出一个应用,与构建企业级软件在治理、责任与专家把关上有本质区别。文章围绕"构建"本身展开,讨论的主体并非应用功能,而是谁来做决定、谁来承担后果。

  8. Martin Fowler(@martinfowler)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jim Highsmith 谈实践者写作:区别于学术写作与思想领导力内容

    Jim Highsmith 认为,实践者的有效写作是一种独立于学术写作和思想领导力内容的文体。相关文章发布于 martinfowler.com。

  9. Scott Wu(@ScottWu46)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 谈 Devin:从 2024 年不够好到如今只差你的野心

    Cognition 表示其价值观是"全都要",面对取舍时选择野心最大化的方向。2024 年推出 Devin 时其设想是每个团队都拥有无限量的初级工程师,但当时 Devin 能力还不够,如今已经够好,剩下的唯一限制是用户愿意有多大的野心。

8月19日周三
  1. Elastic BlogAI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    州与地方政府如何用现有数据提前识别欺诈

    州和地方政府机构可通过统一分散在各部门的数据来提前发现欺诈,而非事后追查。GAO 数据显示联邦项目每年因欺诈损失 2330 亿至 5210 亿美元;加州 EDD 用 Elastic 整合 3000 多台服务器的数据后,威胁平均响应时间减少 99%。USDA 数据显示 SNAP 欺诈交易在 FY2024 第四季度至 FY2025 第一季度间增长 55%。

  2. 张小珺Jùn|商业访谈录AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    17岁高中生苏庭灏独立完成预训练研究,论文被 ICML 2026 收录

    出生于2009年、现年17岁的高二学生苏庭灏独立开展预训练研究,其关于 Attention 机制的论文被 ICML 2026 Main Track 接收。他在这期播客中讲述两年 AI 旅程,包括预训练中"白白丢了1500"而哭鼻子、参加韩国 ICML,以及支教前暂离 AI 的计划。他观察到 AI 让好学生成绩更好,也让同学对人生意义感产生动摇,而他给出的答案是"开心是人之根本"。

  3. Microsoft Research(@MSFTResearch)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Doug Burger 等探讨 AI 的气候影响与可持续发展路径

    Microsoft Research 的 Doug Burger、Amy Luers 和 Ishai Menache 探讨 AI 的气候影响,以及如何引导这项技术支撑可持续未来。他们将 AI 与互联网、社交媒体类比,指出每项强大的新技术都伴随取舍。

8月18日周二
  1. Martin Fowler(@martinfowler)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Martin Fowler 新专栏 Rachel's Ramblings、XConf Europe,以及 AI 为何尚未带来大幅生产力提升

    Martin Fowler 在最新 Fragments 中介绍了新专栏 Rachel's Ramblings 与 XConf Europe,并讨论了 AI 至今未带来大幅生产力提升的原因、选举数据可视化、AI 安全挑战以及 AI 在中国的影响。

  2. Anton Osika – eu/acc(@antonosika)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovable 创始人 Anton Osika:做产品要走出去和用户聊,别坐在桌前空想

    Lovable 创始人 Anton Osika 表示,做生意的关键是做出让人们觉得价值高于付出的产品,而这没法坐在桌前想出来,必须和潜在用户交流以弄清该解决哪些问题、产品下一步往哪走。他举例说几天前在桑拿船上大部分时间都在问船主最大的痛点是什么、Lovable 能怎么帮上忙,并称与客户交谈的方式虽在演变,仍是他最喜欢的工作环节之一。

  3. Web3天空之城AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    李飞飞对话安德鲁·休伯曼:智能的基石与未来

    李飞飞在 Huberman Lab 播客中与斯坦福神经科学教授 Andrew Huberman 对话,将智能追溯至5.4亿年前视觉的进化起源,并指出大数据、GPU 算力与神经网络算法三者于 2012 年汇合,成就了 ImageNet 引发的现代 AI 飞跃。

  4. Naval(@naval)AI 评估 · 7/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Guillermo Rauch 分享 ✌.com 与 ▲.to 链接

    Vercel CEO Guillermo Rauch 在推文中分享了短链接 ✌.com 和 ▲.to,原推获得 106 条回复、63 次转发、2804 次点赞和约 132 万次浏览。推文同时引用了另一条推文(View Quoted Tweet)。

  5. Kevin Weil 🇺🇸(@kevinweil)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Kevin Weil:别让 AGI 只用于企业生产力,却错过科学加速

    Kevin Weil 赞同 Fidji Simo 的观点,认为不应让 AGI 只服务于企业生产力而错过科学加速。他指出,从更聪明的模型到治愈疾病之间缺失大量基础设施,许多地方缺乏理解疾病所需的生物数据。他因此最看好 AI 率先在癌症领域取得突破,因为基因组学、病理、影像等领域已有数十年积累的数据集,但模型智能与生物基础设施必须同步扩展。

  6. AI炼金术AI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    艾语智能张天乐:赚钱的 AI 产品与原生的 AI 组织

    艾语智能创始人张天乐在对话中讲述公司如何服务六七十家金融机构、每月从 3000 个法院提起立案 1 到 2 万件,按回款约 30% 拿佣金,并坚持不做 AI 电话催收。

  7. 枫言枫语AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vol. 172 Codex 卖重置套餐,DeepSeek 峰谷调价,苹果重回 5 万亿等

    本期播客盘点近期模型密集发布:Qwen 3.8 Max、DeepSeek V4 Flash 与 Pro、字节 SeeDance 2.5、MiniMax H3 相继登场,DeepSeek V4 Pro 按波峰波谷收费。Codex 被传售卖 Reset 套餐,并发布 Computer History,允许用户授权记录学习其鼠标键盘操作。苹果市值突破 5 万亿美元重回第一。

  8. 此话当真AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从「同事.skill」到「人生系统」:两个年轻 Builder 的公开实验

    周天奕花四小时用 Claude 做出「同事.skill」,可读取飞书、钉钉、Slack、微信聊天记录及 Markdown 文档,把人的技术能力、沟通风格和决策习惯「蒸馏」成可调用的 AI 技能包,上线 5 天在 GitHub 收获 7.3k 星标、累计 23k,衍生出 200 多个 skills。

8月17日周一
  1. Interconnects AI — Nathan LambertAI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nathan Lambert:为什么开源模型训练正在变成一场经济豪赌

    Nathan Lambert 认为,开源语言模型(带完整训练配方)更像开源操作系统,而开放权重模型只是基于它构建的软件版本,二者不应混为一谈。Nvidia 据报投入 260 亿美元推进近乎开源的 Nemotron 等模型,目的是让无数公司都能造"token 机器",从而持续拉动其芯片需求。

  2. Naval(@naval)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Naval:别给我报告,给我提示词就行

    Naval 发帖称"别把报告发给我,把提示词发给我就行",该帖获得 11628 次点赞、642 次转发和 65.4 万次浏览。内容由 xgo.ing 提供支持。

  3. 前端充电宝AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    团队准备解散了:Agent 架构师岗薪资高 30%-80% 的进阶实战营

    随着 Agent 接入企业核心业务线,能搭 ReAct Loop、接 MCP、把 Skills 做成资产的 Agent 架构师需求飙升,同城市同年限薪资普遍比传统程序员高 30%—80%。

  4. 晚点聊 LateTalkAI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    晚点聊 179 期:蒸馏风暴——一场无人公开谈论的技术竞赛

    《晚点聊》第 179 期与《晚点 LatePost》主笔高洪浩讨论蒸馏,这一技术从早期的模型压缩演变为让模型变强的手段,并在 2026 年出圈。节目提到字节讨论训练超 5 万亿参数模型,张一鸣判断不蒸馏、也不被 Coding 这类短期热点影响,认为蒸馏最多只能逼近、很难真正超越。讨论还涉及智能体轨迹蒸馏、大规模蒸馏的数据管线与 know-how、蒸馏行为能否被隐藏,以及学生模型能否超越教师模型。