Thinking Machines:值得构建的未来属于人类
Thinking Machines 提出要构建"扩展人类意志与判断"的AI,主张AI不应在少数地方训练后就被冻结,而应像人一样多样、分布式。为此它推进多模态交互与可定制化、支持用户训练模型权重、开发拓宽人机沟通的界面,并公开研究。
Thinking Machines 提出要构建"扩展人类意志与判断"的AI,主张AI不应在少数地方训练后就被冻结,而应像人一样多样、分布式。为此它推进多模态交互与可定制化、支持用户训练模型权重、开发拓宽人机沟通的界面,并公开研究。
Richard Ngo 批评 AI Futures Project 的 AI 2040 场景:它既非预测也非建议,而是"乐观预测",导致读者无法分辨哪些部分是作者认为理想、哪些只是为求现实感而保留。
Andrew Ng 引用 Adam Thierer 的《Permissionless Innovation》一书,主张创新不应事先向政府申请许可,保护开源 AI 是其中关键部分。Thierer 警告美国 AI 治理正走向非透明、零散的模型审查流程,若形成"限制至许可"的默认规则,开源模型将难以合规。
心理健康应用面临严重的留存危机:约 95% 的用户在第 1 天打开后 30 天内流失,30 天留存中位数仅 3.3%,即便是头部产品前 10 天也会流失约 50% 用户。文章指出,许多 UI 趋势以吸引注意和标榜创新为目标,与心理健康应用所需的降低认知负担、建立信任相冲突,新潮布局、隐藏导航和抽象图标会在用户最脆弱时增加使用成本。
短剧行业正分化为"卷规模"与"卷创作"两条路径,日新阅益文化董事长侯超与刚刚好影视董事长李佳佳在「乱翻书」播客中拆解两种打法:25万一部与80万一部对应不同策略,核心是"第一本金安全,第二利润规模"。两人认为卷剧本、卷体系可行,卷成本是卷错了方向,并指出 AI 与真人短剧已分属两条赛道——AI 保下限,真人冲上限。
Modal 认为自己是"一台计算机":用容器内存充当内存层级,通过 I/O Plane 出入数据,路由则经由 Routing Plane 或直接 Tunnels。
有人提议在 Kickstarter 上众筹一款 Claude Clock。原帖仅此一句,未透露该时钟的具体功能、价格或上线时间。
Midjourney 官方账号分享了一个 x.com 的 Space 直播链接。该帖获得 18300 次浏览、24 个点赞、12 条回复和 2 次转发。
Sam Altman 宣布 GPT-5.6 sol 将于周四发布,并附上"happy building"。该推文获得 391 个赞、32 条回复、4 次转发和 64095 次浏览,引发外界讨论 Google 此时相对 OpenAI 的领先之处。
英伟达 RTX Spark 以 1 Petaflop 算力和 128GB 统一内存,让消费级 PC 本地跑 120B 至 200B 参数大模型成为可能,端侧 AI 硬件就位。
Anthropic 在 Q2 2026 的 RSI 博客称其贡献者日均合并代码量是 2021-2024 年的 8 倍。基于 Cobb-Douglas 与 CES 生产函数建模,Thomas Kwa 推断仅凭编程智能体带来的研究员提效就超过 2 倍:Cobb-Douglas 在 β=0.5 下给出约 2.83 倍,CES 均质代码情形为 [2.75, 2.91]。
Coinbase 已把编码任务交给 GLM 和 Kimi,费用砍半;视频还讨论了如何用国产模型"白嫖" Claude Code 全生态。中国能把 TOKEN 成本压到海外的 1/5 并免费开放,豆包一宣布收费就被骂"忘记初心",WorkBuddy 和 Trae 也突然爆火。
李继刚提出,「预测」是一种强大的「选择压」,会逼迫人放弃模糊理解、只留下对「结构」的判断。LLM 靠预测下一个 token 学到了语言的结构,人也应靠预测所在领域的下一步,逼自己看见这个领域真正的生成机制。
Stanford EE 博士 JY 创办的 Vocci 推出了一枚钛金属、3 克重、防水的 AI 戒指,他主张不做"AI 硬件"而做"AGI 配件"。他在这期播客中分享了"配件"而非"硬件"的产品定位、月费心理门槛、融资经历,以及硬件研发量产与工程卓越的思考。Vocci 官网为 vocci.ai,并为听众提供 $30 折扣码 AVOCADOVOCCI,有效期至 2026 年 7 月 29 日。
伯克利 EPIC Data Lab 提出,推理价格已从 2023 年初 GPT-4 级约 $30/百万 token 降至如今不到 $1,部分厂商低于 $0.10,年均降幅中位数近 50 倍,近乎免费的智能正在到来。
Lilian Weng 发布新文章,探讨 harness 工程如何推动 AI 自我改进。她认为 harness 工程或将朝自我改进方向演进并实现自动研究,而更聪明的模型又会让 harness 保持简单;即便许多 harness 改进最终被内化进核心模型,明确目标与上下文的需求也不会消失。
李继刚提出一个疑问:J-space 是否是 LLM 的"白板"。该帖获得 4 条回复、2 次转发、30 个点赞与 10567 次浏览。
Epoch AI 指出,AI 未来主义辩论普遍只讨论 AI 能变得多强,却忽略具体技术的开发难度这一半,因此提出三步研究法:明确定义某项技术、设定 AI 能力假设(如"可替代远程工作者"、需 H100 GPU 运行时算力)、估算该 AI 开发该技术所需时间与资源。目前公开案例极少,Damon Binder 的后 AGI 能源生产研究是其一。
Anthropic 发布了一份由 Claude Code 早期团队成员和首批用户共同讲述的简短历史,回顾这款产品从无到有的过程。完整内容可在 Anthropic 官网的 "making of" 专题页面查看。
Adobe 的授权条款被质疑:用户即便自行生成图片,只要其中一部分源自另一张图片,仍须向 Adobe 支付版税。该说法在社交平台上引发批评,被认为是不合理的收费主张。
Martin Fowler 发布 Fragments 文章,谈及第二届"软件开发未来"研讨会、与 AI 协作的伦理问题、借 DMCA 实施的审查,以及对 token 高成本的反应。文中还提及一份 1776 年的激进文档。
Modal 发布交互式成本估算工具,用于比较 serverless GPU 与预留 GPU 的经济性,模型默认采用 B200 的 Modal serverless 当前费率及超大规模云厂商三年预留价格。
李继刚「人生周报v080」以 Bayes 为主题,推荐日本作者所写的《统计学关我什么事》,并用先验、似然比、后验五步取景框分析问题。文中还提出「语言是一种技术」、把进化论引入笔记系统让笔记每天繁衍变异,并分享生成 PPT 的 skill /ljg-present。
李继刚提出,技术是人类将能力外化为系统、降低某种稀缺能力成本的过程;当这种能力足够便宜和普遍,就会反过来重塑社会结构、认知方式和人的自我理解。他认为语言也是一种技术,我们正在经历一次新的自我理解过程。
Apodex两位首席科学家杜少雷和李辈滨在硅谷101播客中预测,最快半年AI就能跑通一次完整的自我进化闭环,但解决递归漂移还需2-3年。这家由陈天桥主导的公司只做heavy duty solver,其discovery model强调提出人类未想到的假设并自我验证,方法之一是多个子agent互相验证。随着模型能力变强、长程任务表现更好,RSI概念才真正走热。
播客《天真不天真》vol.52 中,杨天真与王安宇从十年前签约回望,聊到外界评价、行业转折与个人经历,王安宇提到自己被"保底工资"和"固定住所"吸引而签约。两人还谈到 AI 带来创作平权、真情实感仍是打动人的核心,以及如何看待流量、信任与命运馈赠。
深度参与过字节和美团组织建设的魏小康认为,招聘 80%、90% 的时间应花在「想清楚需求」和「找供给」上,而非面试环节。他表示创业公司早期不需要搞绩效、职级晋升体系,人是打完仗淘汰筛选出来的,并称「今天之后的每一天,都是你最好招人的时候」,因为 AI 发展会让供需越来越紧张。他目前正在开发一款 AI 招聘产品。
Andrej Karpathy 称赞某模型的 three.js 环境生成能力属于顶级水平,认为每一代新模型层级都会带来质的跃升和惊喜。他指出模型能仅凭互联网知识就将其理解转化为 xyz 坐标、meshes、transforms、动画、特效与交互式小故事,并对更高模型层级能创造什么感到惊叹。
这期播客从库克的阿拉巴马小镇少年时期讲到他接班乔布斯,串起 IBM、康柏到苹果的经历。核心线索是他如何用供应链管理改变苹果:库存从 30 天压到 6 天,以及 iPod、iPhone、自研芯片、App Store 和苹果税如何把苹果从产品公司变成商业帝国。节目最后提到苹果已宣布约翰·特纳斯接替在位 15 年的库克出任 CEO。
Sundar Pichai 在 7 月 4 日发文,称无论怎么拼写,250 年的美国创新、独创精神与好奇心都值得庆祝,并祝愿大家度过一个快乐安全的独立日。
Meta CTO Andrew Bosworth 与 General Matter 创始团队成员 Lee Robinson 在一档播客中主张,科技从业者应把才华用于服务国家利益,从 LLM 到铀浓缩。
AI Breakfast 发布的一条推文获得 241 个点赞、13 次转发、9 条回复和 15791 次浏览。
李继刚把书架比作大脑的训练语料,指出多数人对选书毫无门槛:畅销榜推什么读什么,等于拿互联网噪声训练自己的神经网络。他认为"多"不是好指标,关键是你允许谁的思想进入你的权重,每读一本平庸的书都是在用平庸覆盖本可形成的结构、占用梯度更新方向。
Lilian Weng 在 Lil'Log 发表长文,系统梳理 harness engineering 与递归自我改进(RSI)的研究脉络。文章把 harness 定义为围绕基座模型、负责编排执行与上下文管理的系统,并归纳出工作流自动化、文件系统作持久记忆、子智能体与后台任务三类设计模式。
Merriam-Webster 在 X 上解释为何英式拼写用 cancelled、美式拼写用 canceled,并调侃称是因为 1776 年美国把那个 "l" 留给了英国。该推文获得 78 个点赞、3 次转发,浏览量 17815 次。
Mistral AI 表示其使命是帮助企业和公共机构构建自己的智能,使数据、工作流、反馈和模型所创造的价值归属于客户自身,而非模型提供商。该表态由 Arthur Mensch 发出,强调客户并非抽象概念。
Smashing Magazine 文章指出,用户真正需要的不是更多新工具,而是契合既有心智模型的无缝集成,用来解决高频、高严重度、高挫败感的问题。文章推荐"Quiet AI",即隐于后台默默做事、不争抢注意力的助手,并以 Claude 集成 Microsoft Excel、PowerPoint 和 Word 为例。
一条推文以"jb in exchange of pg? what?"发问,未提供更多背景或说明。该帖获得 29 个点赞、6 条回复,浏览量 21442 次。
Augment Code 发布了一条完整节目视频,附有 YouTube 观看链接。该帖互动数据为 0 条评论、1 次转发、1 个点赞、1349 次观看,由 xgo.ing 提供支持。
Augment Code 提出"IDE 已死"的判断,并抛出"然后呢"的追问。该帖仅附一段视频,未展开具体论据或替代方案。