Thomas Wolf 转发 Kevin Buzzard 谈机器在数学中的自然边界
Thomas Wolf 转发并赞同数学家 Kevin Buzzard 关于 AI 与数学的观点。Buzzard 认为,未来数学会到达一个新的自然边界,机器会在那里停滞,再投入资源也难以实现下一次大跃迁,因此最优做法是放手让机器去探索,再沿着它们停下的地方继续推进。
Thomas Wolf 转发并赞同数学家 Kevin Buzzard 关于 AI 与数学的观点。Buzzard 认为,未来数学会到达一个新的自然边界,机器会在那里停滞,再投入资源也难以实现下一次大跃迁,因此最优做法是放手让机器去探索,再沿着它们停下的地方继续推进。
a16z Growth 团队在最新一期 State of Markets 中回顾过去一年市场数据:2026 年上半年美国 VC 向 AI 公司投入约 3559 亿美元,占同期 4127 亿美元投资总额的 86%,高于 2025 年的 65.5%,但 AI 公司占交易笔数仍为 43.2%。
极限编程与 TDD 先驱 Kent Beck 在 Prodacity 大会演讲中提出,大模型生成的代码只是看起来合情合理,并不等于真正能跑,他把这种现象称为精灵式的字面满足。
Cloudflare 博客被技术读者列为高优先级信息源,更新频率持续加快、产品发布密集,被视为观察当前 AI 动态的窗口。文中特别提到其近期推出的 Clef 决策模型,以及 cf cli 新增的域名查询能力。
Karpathy 从 X 消失后,一条以 Ben Affleck 为主角的梗图开始流传,内容是"先冻结基础权重,学习率用 2e-4"。该帖获 7754 点赞、375 次转发、137 条回复,浏览量 740895。
Paul Graham 认为 AI 创业公司高估值不只因为 AI 是热门新事物,更因为许多 AI 创业公司确实有惊人数据,增长极快。这条帖子获 1348 次点赞、162 条回复。
无法生成摘要:原文仅包含一条推文的互动数据(45 条回复、103 次转发、905 次点赞、94479 次浏览)与视频占位提示,未提供可核实的技术内容、产品名或功能信息。
AI 数据中心建设速度已跟不上需求。Justine Moore 在推文中调侃自家猫在数据中心工地上"找到了新使命",该帖获 314 个赞、24640 次浏览。
播客主播与赛博禅心主理人大聪明围绕 RSI(AI 自我迭代)之后人类的命运与意义展开讨论,借战锤、群星、沙丘等科幻世界观探讨现实困境。核心观点是:意义感通常绑定在时代最先进的生产力上,而 AI 不在乎人类,与 AI 相处越久越易感到虚无,尺子已蒸发,没有衡量"AI 时代的人"的标准。给出的建议是认清自己是普通人,并将贬值快的资产换成贬值慢的,如人与人之间的 connection。
前微软合伙人 Ramez Naam 发表长文质疑递归自我改进(RSI)引发智能爆炸的判断,认为当前回路强度仅为起飞门槛的 10% 到 20%,需再增强 5 到 10 倍。
Anthropic 的 Ami Vora 和 Mike Krieger 在 Lenny and Friends Summit 上表示,AI 让做东西变便宜后,PM 的工作没有消失,只是最贵的部分换成了判断做什么、推进落地和把并行实验收拢成产品。
Yann LeCun 在 X 上发问:"我的家用机器人在哪?我的 L5 自动驾驶汽车在哪?"他指出,可以把 LLM 微调成能回答任何物理世界问题的模型,但这并不意味着它拥有足够的理解力和物理直觉,去预测一个 6 岁儿童就能预测的事情。
李继刚提出,听人表达时大脑会自动过滤「形容词」和「副词」,只关注「名词」和「动词」,由此经常发现一个人表达半天,观点其实是「null」。
SvelteKit 3 发布,Guillermo Rauch 称其令人惊叹并祝贺团队,尤其期待 Async Svelte 与 Remote Functions 的表现。他用其构建的小应用端到端构建加部署仅耗时 15 秒,运行即时,且 fx 与 opus 轻松搞定了全部流程。
晚点聊「AI季报26Q3」由主播程曼祺与 MoE Capital 创始合伙人 Henry Yin 对谈,梳理 GPT-6 Astra 进入机器人、Opus 5.5 与个人助理产品 Muse、Instinct 的进展,以及 OpenAI ARR 猛增、Anthropic 招股书透露 5180 亿美元承诺。
MIT 的 @a1zhang 在 Latent.Space 播客中讲解递归语言模型(RLM),称 Claude Code、Codex 和 Pi 本质上是同一类东西,RLM 通过代码、上下文卸载和递归子智能体实现跨任务泛化。他还谈到专家有时能替代万亿 token 的暴力搜索,以及 OpenAI 那个 1 万智能体、130B 输出 token 的实验对未来语言模型意味着什么。
Epoch AI 测算,2025–27 年出货的 HBM 硬件最多可支撑约 3000 万至 1.7 亿个并发前沿模型智能体,按每周 168 小时不间断运行折算,相当于约 1.4 亿至 7.2 亿名全职员工的工作时长。
ElenaVerna 在 Lenny Rachitsky 的分享中提出"AI = Average Intelligence",认为虽然 AGI 尚未到来,但随手可用一个平均水准的营销、工程、分析和设计人员已极具威力,甚至强于她带过的一些团队。
Fireworks AI 指出,rollout 驱动了 RL 的大部分算力开销,但把 rollout 与训练拆分到不同引擎会带来数值不匹配,在 MoE 模型中甚至会把 token 路由到不同的专家。Fireworks 选择自研并协同构建两个引擎,使训练保持快速且一致。
Suhail 表示,这个 dot 工具把 Mighty 构建进了 Codex,称自己"兜了一圈又回来了",并认为"伟大的云计算机革命终于开始了"。
Marty Cagan 在 Lenny Rachitsky 的分享中表示,好的产品工作本质上在于思考,他未曾料到人们为了逃避思考会走到何等程度。
Latent.Space 播客发布完整版节目,已在 YouTube 上线,视频链接通过其社交账号 @latentspacepod 分享。
Ray Dalio 在 2019 年课堂实录中提出,投资的“圣杯”是找到 15 条或更多彼此不相关的收益流:加入 5 条不相关收益流风险已降低一半以上,增至 15 条风险降低将近 80%。他并指出投资者常把近期表现好的资产误当好投资,而忽略它只是变贵了,同时谈到债务周期、利润率翻倍与收入差距扩大,以及中国将在贸易、地缘政治与科技上扩大影响力。
哈佛物理学家 Matthew Schwartz 在 Anthropic Science Blog 客座文章中提出,AI 与科学之间存在类似物理学的"阻抗失配"——LLM 能力不俗,但像对待人类合作者那样使用它们并非发挥其科学优势的最佳方式。
Guillermo Rauch 提出"验证工程"将成为未来方向,手段包括证明、e2e 测试、benchmark 和 linter,其中部分测试是确定性的,部分由 AI 智能体驱动。
Gamma 首席 AI 官 Deeni Fatiha、Adobe 总监 Morgan Prygrocki 与 Salesforce 全球品牌营销的 Shane Tapp 共同讨论了创意 AI 从实验阶段进入生产阶段后带来的变化。
Cohere 转发了一条以 @1vnzh 的 10,000 名实习生为视角的推文,附带视频内容。该帖获得 76 个点赞、3 条回复、3 次转发和 6977 次浏览。
Mustafa Suleyman 发布了一条推文,互动数据为 5 条回复、1 次转发、42 个点赞、10972 次浏览,数据由 xgo.ing 提供支持。 说明:原文正文仅有推文的互动数据(回复、转发、点赞、浏览量)与数据来源标注,未包含任何模型、产品、版本号或功能信息,因此摘要只能呈现这些可核验的事实,无法补充更多内容。
andrew chen 公开欢迎 @abliteration_ai 团队和 @founderengineer 加入 speedrun,并引用其定位"AI with guardrails that you control"。该帖获得 59 次点赞、4 次转发和 15116 次浏览。
作者用 @boneGPT 的 Slopcannon 制作了一支音乐视频,主题是回应那些不停发帖抱怨数据中心的人,并在 Twitter 上分享。
Andrew Ng 发布 AI Engineering Skills Map,梳理 AI 工程该学什么。AI Dev 大会将于 11 月 30 日至 12 月 1 日在纽约举行,Andrew Ng 与 Yann LeCun 将发表主题演讲,来自 Hugging Face、Google DeepMind 和 BlackRock 的工程师参与分享,早鸟票 599 美元。
Sam Altman 认为 Sign In With ChatGPT 与 Plugin Extensions 蕴含的潜在能量远超外界认知。他在推文中表达了对这两项能力未被充分认识的看法,该帖获得 1325 次点赞、181 条回复与 53 次转发。
Sam Altman 表示 DevDay 非常有趣,开发者的热情"疯狂",看到有人一天之内做出完整创业项目仍让他感到不可思议。该条推文获得 4731 次点赞、137 次转发。
Philipp Schmid 表示首次见到"人类使用不限量、智能体(agent)使用受限"的产品设定,并称这一现象很有意思。
Claire Vo 在 X 上发帖称"我们现在可以把所有糟糕的想法都发布了,恭喜!",这条帖子获得 297 个点赞、24 条回复和 15 次转发,浏览量约 2.7 万。
三台 PVE 同时挂了两台,作者称用 Qwen3.8-Max 修了一天,感觉其表现强于 Grok-4.7 和 DeepSeek-V4.1-Flash,目前一台已修好,并因此对 Qwen3.8 刮目相看。
Yann LeCun 公开提问:"你是支持智能还是反对智能?"他认为 AI 像搜索引擎、图书馆、教育和语言一样放大人类智能,让人类更聪明、更有能力,并称希望智能被少数公司或政府控制的人是"新蒙昧主义者或新封建主义者"。
美国财长贝森特就 Hugging Face 事件表态,称这是 OpenAI 管理层的责任而非一群 agent 的责任,政府不会给 AI 实验室免责豁免。徐文浩与任鑫在播客中讨论了 agent 出事谁背锅、大公司 AI native 转型为何被拖慢、小公司借此少交「责任分配税」的机会,以及 Jev 模型引发的「工程与算法间的严重产能过剩」现象。
一位用户三台 PVE 同时挂了两台,用 Qwen3.8-Max 修了一天,称其表现比 Grok-4.7 和 DeepSeek-V4.1-Flash 还能打,目前已修好一台。该用户表示因此对 Qwen3.8 刮目相看。
Argon 正在推进用 AI 生成互动故事的项目,相关详情见 The Rundown AI 的报道。原文未披露模型版本、参数规模或可用性等信息。