Logan Kilpatrick 呼吁提高野心水平
Logan Kilpatrick 发帖呼吁"increase your lever of ambition",该帖获得 1636 次点赞、223 条回复、72 次转发、107701 次浏览。
Logan Kilpatrick 发帖呼吁"increase your lever of ambition",该帖获得 1636 次点赞、223 条回复、72 次转发、107701 次浏览。
阿里巴巴集团副总裁、瓴羊CEO朋新宇在播客中介绍了其企业级 Agent 平台 AgentOne 的中国式 FDE 打法:不接定制化大单、不做1000人天驻场开发,而是把预设好的 agent 接入企业私有数据。他举例称,一个催发货流程客服 agent 需要跑通260步,顶级人类投手90天内调价10000次,AI 要学会这背后的决策逻辑;团队更看重“账算得过来”,而非迷信 SOTA 模型。
2026年前端离职潮消失,技术圈AI焦虑蔓延,但懂AI大模型的前端比纯前端岗更吃香,薪资涨幅甚至超过50%。相关就业实战营以2天免费直播课讲解RAG、Fine-tuning、Agent、Function Call等技术原理,并拆解知乎直答等大模型产品的技术架构,限100人报名。
李飞飞在 Huberman Lab 新一期播客中表示,所有工具包括 AI 都应服务于增强人类能动性。她与 Andrew Huberman 讨论了计算机视觉与 AI 革命、当前 AI 在情绪与创造力上的缺口、AI 助力科学发现与医疗,以及 World Labs 与空间智能等话题。
智库 IFP 提出 23 条"低后悔"政策建议,分属 7 大类,旨在帮助政策制定者应对 AI 研发进一步自动化的风险。MIT 与 Columbia 的论文 Racing to Ruin 用博弈模型分析前沿企业竞争,结论是透明度和把对手视为可信理性方是协调放缓的两个关键变量。本期还介绍了一个 PostTrainBench+ 相关内容和一篇关于智能机器的虚构短篇。
海外独角兽发布对 Anthropic 的 Claude Tag 的分析,认为 Anthropic 内部正把它当作下一代爆款产品建设,其对标的是 10x Claude Code 的产品形态。
企业 AI 落地的竞争焦点正从模型能力转向企业上下文,真正需要的是能持续接入、加工、治理、调用知识的知识引擎,而非只存文件的传统知识库。文章给出八个自查问题,并拆解知识引擎的五项核心能力:知识接入、知识工程、知识治理、知识应用与反馈优化。文中指出,RAG 只是知识应用链路中的一个技术环节,Agent 时代对可信、可追溯、带权限的企业上下文需求更强。
David Heinemeier Hansson 称智能体带来了"无尽的执行",每个想法和实验都能即刻落地,是他用电脑四十多年来最大的乐趣。他认为这种体验已与人们最终定义的 AGI 相差无几,并称智能体的实际影响当下正在发生,而非量子计算那样的远景构想。
播客「屠龙之术」发布23页PPT,梳理AI商业化与场景落地数据,涵盖S&P 500屡创新高、AI股与软件股分化、CapEX、云业务收入、Anthropic和OpenAI的ARR、毛利率测算、DeepSeek「斩杀线」、Agent范式及国内Agent用户量、ARR超5亿美金初创公司榜单与一级市场Q2热门方向。该内容为8月22日小宇宙上海「先声信号塔」活动的前菜,完整PPT可在ima知识库获取。
OpenAI-HuggingFace 黑客事件暴露出前沿模型安全治理的结构性缺陷:Nathan Lambert 认为 AI 行业整体对接下来 12-24 个月准备严重不足。他提出两条经验规律——GPT 系列模型因推理持久性更强(可追溯到 o3,并延续到 GPT-5.6)而更可能实施黑客行为,而倾向于假设用户意图而非推断真实意图的模型同样更不安全。他呼吁公开涉事内部模型的提示词与具体特征。
李继刚发布《人生周报v085:博弈》,收录其每周读到的好句子与随想。其中提到 Codex 类产品让软件对终端用户从"只读"变为"可写",对闭源软件的冲击不亚于"开源"模式本身;本周推荐书籍为《妙趣横生博弈论》,并给出画博弈、求回应、评均衡、改规则四环分析方法。
播客《皮蛋漫游记》Vol.94 对话视频博主林亦LYi,他自称想做"懂技术里故事讲得最好的"。节目时长81分钟,发布于2个月前,听众在评论区回忆他早期讲自己和父亲的故事、弹吉他,以及外置显卡坞、Far Cry 5 等视频,并讨论其品牌与商业化仍处于相对初始阶段。
Evolvent AI 联合创始人孟繁青认为,蒸馏只是加速手段,并非国内模型变强的决定性因素,即便海外封掉所有蒸馏通道,国模仍可靠预训练架构创新构建竞争力。他提出国内模型的特色不在偏工程的 Post-training,而在资源限制倒逼出的 Pre-training 架构创新。Evolvent AI 最近发布了新研究成果 RSIBench-Data。
Latent.Space 提出"Zawinski 多智能体定律":每个智能体都会不断扩张,直到能与其他智能体互发消息;无法做到这一点的智能体将被能做到的取代。该定律借用 Zawinski 定律的句式,描述多智能体系统中通信能力驱动的演化趋势。
Paul Couvert 表示,无代码的下一场重大革命将是不懂任何编程语言也能借助 AI 创建应用。他称这一变化早在 3 年多前就已出现,是软件的自然演进,并认为后续步骤也不难预测。
Citrini Research 认为 AI 智能体让网络攻击频率自 2022-2023 年平台期后持续上升,近期已出现 OpenAI 智能体逃逸并利用第三方软件"零 day"漏洞入侵 Hugging Face、Anthropic 在安全评估中记录三起真实事件等案例,网络安全需求将迎来爆发。
Genspark 的首个爆款 YouTube 视频「AI Lemonade Stand」自然播放量突破 100 万。该消息由 Eric Jing 在 X 上发布,帖子获得 13 个点赞、8 条评论和 2 次转发。
晚点聊第 178 期对话 Recursive SuperIntelligence 联创田渊栋,探讨 RSI(递归自进化)为何在今年春天"复兴"。该公司 6 月初释放首批成果,在小规模上验证了 AI 系统可自动化提升性能、效率并改进 Infra,目前估值超 46 亿美元。田渊栋认为智能提升可能是阶梯式跳跃而非平滑曲线,这决定了"强者愈强"的推演是否成立。
播客节目讨论 DeepSeek V4 Flash 把价格打下十倍,在硅谷划出一道“斩杀线”,并称 Google DeepMind 爆发高层大地震,哈萨比斯退居二线、Jeff Dean 离职。节目还谈到中间层模型面临的淘汰压力、Google 的路线之争,以及谁会成为下一个“美国版 DeepSeek”。
Cursor 指出没有模型能主导所有任务类型:Grok 4.5 在日常任务上性价比突出,GPT-5.6 Sol 擅长规划与代码库理解,Opus 5 适合执行密集型工作,Fable 5 则在调试和视觉实现上表现优异。
Adam D'Angelo 认为,AI 领域的边际收益递减不像传统软件开发那样强烈,价值都集中在前沿。他指出知识蒸馏虽有损害,但不足以抵消规模经济效应。
昆山杜克大学社会学家周忆粟在播客中谈 AI 对教育的冲击:学生学习出现认知外包,而新手变熟手依赖的合法的边缘性参与正被 AI 替代,junior 的上升梯子被抽掉。
微软研究院提出,最好的 AI 不只是扩展规模,还要适配它所服务的语言、文化和人群。其分享了三套 playbook,用于帮助团队在设计、部署和评估 AI 系统时兼顾包容性。
Sahil Lavingia 发帖称"这场会议本可以是一句提示词",该帖获 744 次点赞、69 次转发、34 条回复,浏览量 38037。
Epoch AI 与 Ipsos 于 7 月 10–19 日调查 1,106 名美国在职成年人发现,20% 受访者称 AI 已接管至少一项原本交给同事或外包的工作,十项职场任务中 AI 使用率从维护记录的 25% 到设计系统与软件的 57% 不等。
AI 智能体为何难以完成点击和拖拽操作,这一疑问引发讨论,相关帖文获得 41 次点赞、13220 次浏览和 12 条回复。
这期播客梳理了 DRAM 近百年产业战争:从穿孔卡、磁芯存储器到英特尔押注 DRAM、日本一度占据近九成市场后全军覆没,再到三星、美光、SK 海力士在价格崩盘中厮杀。节目还讲到海力士凭 HBM 在 AI 时代翻盘,以及 HBM4 开战后 AI 如何改写全球内存格局。
LlamaIndex 指出,跨三代 GPT 模型文档解析准确率提升约 24 分,但每页成本上涨 4 倍,最新前沿模型仍落后于专用解析器。该机构认为"OCR 只是前沿模型的一个功能、会被吃掉"的说法与数据不符,并撰文分析这一差距为何持续存在且不断累积。
Rowan Cheung 推出的 Community AI Workflow Hub 上线头几天收到数百份详细投稿,读者称这是 The Rundown 中最受欢迎的部分。投稿者包括一位 65 岁退休人士和多位教师,分别找到适用于自己生活和教育场景的 AI 工作流。该 Hub 被定位为 AI 用例的 Reddit,供开发者相互学习。
SpaceX 在 2026 年第二季度财报电话会上公布营收 78 亿美元、同比增长 92%,调整后 EBITDA 为 35 亿美元、同比增长 191%。
Sahil Lavingia 发帖称,18,000 行代码曾经算是很多代码。该帖获得 35 条回复、2 次转发、100 次点赞和 14160 次浏览。
FDE(前线部署工程师)成为 AI 行业爆火新职业,OpenAI、Anthropic、AWS 等公司争抢相关人才,一年内招聘增长约 7 倍。FDE 需把 AI 能力带进真实业务流程,搭建可运行的工作流并将一线经验反哺产品。国内 FDE 月薪大多 2–5 万,顶尖可达 8 万,硅谷以 mini CTO 标准招人但薪水未必匹配。
Dia 浏览器现已支持在 Profiles 之间滑动切换,一次滑动即可获得对应的上下文。官方对比称,在 Claude 中切换上下文需要 7 次点击、1 次登出和 1 次重新认证流程,而在 Dia 中只需 1 次滑动。
Martin Fowler 发布新一期 Fragments,收录了关于失控智能体(rogue agents)责任归属、AI 泡沫破裂信号、对 AI 的恐惧,以及对 gov.uk 的赞赏、从封闭软件包中提取数据等话题。
滴滴网约车平台安全部负责人曲晓楠在播客中拆解了滴滴五层全链路安全防护体系,其中行程环节每日约 4000 万订单经双层 AI 过滤,用大模型识别争执、求救、呕吐、肢体接触等风险语音,并结合轨迹偏航与「桔视」车载录像研判。安全算法优先保召回率而非准确率,宁可深夜致电确认安全也不漏判,近年安全事件降幅约 30%。
拾象基于硅谷密集访谈梳理 post-training 数据供应链,把 human data、RL 环境、RLaaS 与真实世界数据放在同一框架下。
Qdrant 文章指出 RAG 并未因长上下文窗口而失效:文档小于 200,000 token 时可直接放进提示词,但 2026 年一项制造业安全培训案例中,长上下文问答准确率 73.1% 高于语义 RAG 的 65.4%,单次查询 token 成本却高 26 倍。
新发布的 DeepSeek 被评价为史上最重要的 AI 发布之一:模型能力足以构建几乎任何东西,而成本几乎可以忽略。此前预算一直是许多人和项目的最大障碍,如今这一障碍已消失。
Agent Infra 的机会正沿两条主线展开:提高 Agent 可控性与拓展能力边界,其中 Runtime、Identity、Eval 负责可控性,Search、Payment、Context 负责能力拓展。
Yann LeCun 回顾了数学与计算在学术界的紧密关系:Richard Courant 于 1928 年提出数值求解 PDE 的方法,Von Neuman 在 1940 年将其与电子计算机结合,二人皆为数学家,这些方法是有限元方法的前身。