“一个系统基本不更新就是最稳定的”:Gemini 能保持“最稳定”的秘密
一条被广泛传播的说法称,Gemini 之所以能做到“最稳定”,原因在于“一个系统基本不更新就是最稳定的”。该帖由宝玉(@dotey)发出,获得 25 条回复、2 次转发、78 次点赞,浏览 27993 次。
一条被广泛传播的说法称,Gemini 之所以能做到“最稳定”,原因在于“一个系统基本不更新就是最稳定的”。该帖由宝玉(@dotey)发出,获得 25 条回复、2 次转发、78 次点赞,浏览 27993 次。
a16z 的 Top 100 Consumer AI Apps 分析显示,AI 消费前 1% 用户月均支出 903 美元,超过后 50% 用户的总和,而后者的中位数支出仅 25 美元。
前 Google DeepMind 研究员 @Turn_Trout 在纽约 AI 听证会上作证,称他曾试图推动 Google 对 AI 安全作出承诺。他表示 Google 最终从早先的 AI 安全承诺上退缩,其中也包括 Demis Hassabis。
在 NYC 听证会上,@DKokotajlo 呼应 @hilbertspaess 的观点,指出如今大部分代码由 AI 编写,且审查不够仔细,Gary Marcus 称这令人担忧。
Gary Marcus 引用并认同 @hilbertspaess 的观点:如今多数代码由 AI 编写,人们已不再仔细检查这些代码,把如此多的内容交给 AI 是不负责任的。
Tibo 认为互联网上的大多数操作很快将由 AI 智能体完成,Notion 上线 MCP server 后流量激增、被迫重新考虑其经济模型,每个产品团队迟早都要决定是否为智能体而构建。
Jacob Coxon 与 @DKokotajlo 在纽约市议会听证会上发言,Coxon 开场称"我们还不知道如何控制任何 AI 系统"。Gary Marcus 反驳说这不准确:AlphaGo、GPS 导航等 AI 系统并不存在控制问题,真正无法控制的是生成式 AI,因此应暂停这项特定技术直到能控制为止。
a16z 发布第七版 Top 100 消费级 AI 应用榜单,首次加入消费者实际付费情况这一维度。数据显示,目前仅少数消费者为 AI 付费,但支出高度集中在头部,开发者、创作者等重度用户是主力;Olivia Moore 与 Josh Elman 还讨论了个人智能体、ChatGPT、Claude、Gemini 的不同走向,以及 OpenAI 的 $1B 广告收入规模。
a16z 发布第七版 Top 100 消费级 AI 应用榜,首次新增收入排行榜,并保留网页与移动端流量排名。ChatGPT 仍居第一,移动端月活超 10 亿;Claude 升至网页端第 3,月访问量近 10 亿。
David Heinemeier Hansson 撰文反驳气候、不平等与 AI 的普遍末日论,认为人类物质指标从未如此之好,泛化的焦虑只会破坏心智。他指出,若因恐惧 AI 而错失其带来的智能繁荣与创造力爆发,才是真正的损失;气候末日论三十年也未能遏制全球排放增长,反而拖垮了欧洲经济。
一位 Cloudflare 重度用户指出,用户量上去后 Serverless 几乎一定比 VPS 贵,用 Durable Objects 等云平台还有出现天价账单的风险,VPS 被刷最坏只是机器打满、站点挂掉。
Gary Marcus 反驳将 AI 一律冠以"超级智能"(SI)的说法,指出 1965 年的 ELIZA 只是关键词匹配,深蓝只会下棋,早期 Google 搜索算法只能做搜索,最初的 ChatGPT 因不可靠和幻觉严重更像演示而非产品。他讽刺称照此标准自己的 Apple Watch 也算超级智能。此番评论针对 Elon Musk 提出的"不再叫 AI,改叫 SI 更好"。
Gary Marcus 指出 Elon 未理解「AI」与「超级智能」的区别:AI 一词自 1956 年起就是标准术语,而「超级智能」在 Nick Bostrom 2014 年的论述中有特定含义,指在所有领域大幅超越人类认知能力的 AI。他认为混淆这两个术语极具误导性,且对过去 70 年从事 AI 研究的数十万人不尊重。
社交产品「Romi: Make Friends, Have Fun」上线半年多,2025 年 6 月月流水突破百万美元,一度登上美国娱乐畅销榜 Top30。它用市场常见的“Swipe+1v1 视频”机制,切中美国中年离异人群的孤独需求,靠 PGC 匹配供给和订阅(14.99 美元/周、29.99 美元/月、69.99 美元/年)加内购 Coins 变现。
Julien Chaumond 转发并称赞 @mattt 的构想:把 Clippy 与 ChatGPT 宠物这类"生物"以操作系统级别集成进我们的日常生活。推文以 Microduck 作为示例形象。
Import AI 475 期关注群(swarm)扩展:Toby Ord 认为 4 智能体群完成同等任务需约 2 倍 token,但因并行可将耗时减半,群扩展存在类似"踩脚"参数的收益递减。
一位用户抱怨近期 ChatGPT 使用体验灾难性:Astra 太贵用不起,Sol 6 又慢又有幻觉、忽略指令、来回拉扯,Luna 档也出现退化。原本能完成指令明确的小任务,如今还没做完就说提前完成,服务重启失败就直接放弃、不去修复,连 Coding 搭档也从享受变成折磨。
Caltech 的 Anima Anandkumar 团队用物理信息神经网络(PINN),在无边界自由空间、无外加强迫项的条件下跑通了三维欧拉方程的自相似爆破奇点候选解,论文链接发布在 tensorlab.cms.caltech.edu。
Martin Fowler 发布 Fragments 碎片集,谈及 Google 最新模型懂得更少、但假装懂得也更少,并探讨读代码的未来、Ola Bini 被驱逐,以及与 Eric Evans 在 DDD Europe 的对谈。
ACE完成近4000万美元新一轮融资,由头部战投、CCV、顺为资本、Alphaist等投资,成为AI音乐赛道融资额最高的华人创业团队,已有10万付费用户、月收入200万美元。其专业工具ACE Studio内置160多种免版税AI声线和40多种AI乐器,自研模型ACEx单张A100生成一首约4分钟歌曲仅需约30秒。ACE正内测主打roast玩法的AI音乐Agent产品miya.fm。
极客公园文章指出,AI 图像默认生成美女并非偶然:生成模型学习数据分布并从中心取样,而心理学研究显示「平均脸」恰是人眼中的美。Civitai 上 NSFW 图片占比从 2023 年 1 月的 41% 升至 2024 年 12 月的 80%,2024 年一项研究发现用 PickScore 微调模型会增加 NSFW 输出,Grok 的 Spicy 模式则直接向付费用户开放暗示性内容。
有人给 Codex 几个小时和一个 API key,做出一支调侃 Threads 用户的音乐视频:Astra 负责写词,Fal 负责媒体生成,歌曲用 Suno、视频用 MiniMax H3。作者称歌词相当犀利,并反问谁说 LLM 不好笑。
Nathan Baschez 认为 99% 公司让员工各自折腾 Codex、Claude Code 等个人 AI Agent 的模式不是终局,下一步应是共享的「AI 工厂」。与 Skills 不同,工厂要求系统 Shared、Specific、Scrutinized——尤其可审视性决定反馈回路是否存在。他以两家百人咨询公司为例:集中建设共享工厂的一方在学习曲线上可深入约 5 倍。
有用户提醒,收到任何 Claude 的奖励、问卷或邮件都不要点击,例如所谓 250 刀云额度。该用户称,Anthropic 虽然模型非常厉害,但行为可能不那么正派。
一条用 AI 生成的音乐视频以 Threads 用户为主题,在社交平台引发关注。该视频由 Justine Moore 分享,附带的互动数据显示 7 条回复、2 次转发、15 个赞和 1777 次浏览。
逛逛GitHub 盘点 9 月 GitHub 上 20 个热门开源项目,月增 Star 最高的是 Archify,约 3.34 万,用 Skill 把系统描述或代码仓库画成交互式架构图;Ponytail 以约 3.12 万 Star 教 Agent 优先复用现有代码。
法国勃艮第大学2023年实验显示,自由刷45分钟手机的年轻人警觉性与抑制控制能力明显下降,而安静看45分钟纪录片的一组没有这种变化,原因是大脑被迫频繁切换任务、产生「注意力残留」。QuestMobile 2026年中国移动互联网半年报告指出,月活跃用户规模同比仅增长1.2%,月人均使用时长却同比增长7.4%。组织心理学家提出心理脱离、放松、获得新掌控感和控制感四种「恢复体验」,其中控制感常被忽视。
Epoch AI 基于 OpenAI 2026 年 9 月发布的内部数据整理发现,OpenAI 研究人员的编码智能体使用量约每月翻倍。按 API 价格计价,中位数研究员的日均编码智能体支出从 2026 年 1 月的不足 1 美元升至 8 月中旬的 601 美元,第 90 百分位研究员同期超过 7000 美元。
Spring Office Hours 播客 S5E25 由 Dan Vega 和 DaShaun Carter 主持,嘉宾 Josh Long,主题为软件开发未来,并回应近期流传的一个热门观点。
Simon Willison 主张按量计费服务应默认设置硬预算上限,达到额度即停用并返回错误,而非仅发预警邮件;AWS 9 月推出的项目支出限制当时仅向有限客户开放。
腾讯科技报道,随着AI支出上升,美国企业正越来越多地转向价格更低的开放权重模型。AlphaSense 数据显示,今年 8 月和 9 月美国企业财报电话会议和投资者会议中提及开放权重或开源模型的次数是去年同期的 6 倍。
Judith Dada 回应关于 "saturating" 的质疑,提出基准饱和是否意味着这些基准只对人类有效、而对 ASI 并不适用。她同时承认此前的可视化存在 "jagged" 问题,并给出了更新后的图表。
Reducto 的 Adit Abraham 指出,文本摘要有利于检索,结构化表格则有利于推理,因此智能体能否"找到"表格与能否"读"表格是两回事。该观点来自其在 World's Fair 2026 的演讲,AI Engineer NYC 将于 10 月 12 日至 14 日举行。
Andrej Karpathy 提出一个心智模型:如今关注 AI 的人中,99%+ 接触 AI 相关事物不足一年。他把 2026 年之前、甚至 2012 年之前就在 AI 领域的人称为"AI 恐龙",认为这种代际错位让老玩家感到非常困惑。
马斯克规定管理人员收到明确指令的邮件只能有三种回应:解释为何有误、要求澄清、或直接执行,否则将被要求立即辞职。有人将这三条规则套用到 AI Agent 上,但指出 Agent 并不怕被开除。
开发者 idoubi 公开了自己每天使用的 5 款自建应用:termany.sh 用于构建其全部产品,douchat.ai 用于与所有 agent 对话,snapok.app 负责截图,spotcat.ai 用于启动应用,autojev.ai 则为本地 agent 挑选快速模型。他称"做自己每天都用的东西是最好的感觉"。
工业时代人们购买产品,互联网时代人们获取信息,AI 时代人们会越来越直接地购买任务结果。这一判断出自《智能AI时代的商业、组织与战略的本质》,认为谁能在高度复杂、持续变化的智能世界中持续稳定地帮用户完成任务,谁才有机会形成下一阶段最重要的入口和平台。
Meta 的 Muse 登上美国 App Store Productivity 分类第一,评分 4.9、超过 10 万条评分,同时 Meta 开源了 Muse Gadget SDK。
华为推出睿影 Z10 模块相机,通过 HyperClick 超级卡口安装在 Mate 90 Pro Max 典藏版和非凡大师机身背部,内置 1 英寸 5000 万像素 RYYB 传感器和 24mm 到 240mm 的 10 倍连续光学变焦镜头,最大光圈 F2.0-F4.5,价格接近 6000 元。
有观点提出,AGI 出现之后是否会迎来"超级智能中的超级智能",并追问其英文缩写该如何命名。该内容获得 35 条回复、13 次点赞和 16557 次浏览,未给出具体结论或命名方案。