AI 行业碎碎念:OpenAI 发布 dots、GPT 6.1 Sol 缓存降价 50%,Anthropic 稳居第一
OpenAI 发布 dots,personal agent 赛道变得比办公赛道更拥挤。GPT 6.1 Sol 发布后缓存降价 50%,但 Claude 的 sonnet 5.5 跑分已超过 astra,而 6.1 Astra 因安全原因未放出。作者还提到 jev 一周估值达 100 亿美金,头部世界模型公司以 80 亿美金出售。
OpenAI 发布 dots,personal agent 赛道变得比办公赛道更拥挤。GPT 6.1 Sol 发布后缓存降价 50%,但 Claude 的 sonnet 5.5 跑分已超过 astra,而 6.1 Astra 因安全原因未放出。作者还提到 jev 一周估值达 100 亿美金,头部世界模型公司以 80 亿美金出售。
银行正面临协同 AI 智能体集群带来的新型网络安全风险:自主智能体可同时探测多条路径、共享信息并动态调整行为。防御的关键在于把日志、指标、链路追踪、安全事件与身份数据关联起来,借助搜索与可观测性识别单个事件看似合法、组合起来才暴露的异常模式。SOC 需以 AI 辅助调查与响应应对机器速度的攻击,同时对自身 AI 智能体的行为保留权限控制与人工问责。
Replit 称模型持续变聪明,但 harness 不会消失,其职责从替模型做决定转为给模型提供选项。在 Replit Agent 中,主智能体决定何时更深入思考、何时把工作交给子智能体,以及子智能体应投入多少工作量。
personal agent 每切换一次就是一次隐私的大暴露,不同于 coding 和 working agent 切换成本不高。这类产品的独占性因此进一步提高,且高度集中在巨头手里,作者认为人类社会未来会更加集中、更加垄断。
有人称 jev 这类产品毫无壁垒,但其估值一周内达到 100 亿美金;而被炒作半年的世界模型赛道,头部公司以 80 亿美金出售。发帖者借此感叹世界没有对错,也没有谁是傻子。
产品开发者刘小排通过自己常去的两家理发店的对比,指出AI写代码越来越快、做产品门槛越来越低,但真诚仍无法被取代。他描述" S造型"老板记得他半年没来、仍记得他常和同事一起来,而高端连锁"M理容馆"服务人员情绪价值拉满却只是公式化推销办卡。他由此类比产品:有的产品华丽却充满套路,有的产品朴素却由创始人亲自与用户沟通,并以Flomo、早期的沉浸式翻译为例。
软件架构演化被概括为单体→原始分布式→SOA→微服务→云原生,其中SOA的ESB虽是解耦一步却在故障隔离上倒退,因此互联网公司普遍弃用。文章指出解耦粒度细化与故障域隔离强化是两条主线,理念已从追求零故障转向设计容错性。AI Agent 打破云原生无状态前提,带来不确定性、状态管理、动态编排与可观测性四重挑战。
硅谷101播客邀请资深大宗商品期货交易员张思齐,解析这场50年来罕见的超级厄尔尼诺如何影响棕榈油、天然橡胶、咖啡豆等农产品供给。摩根大通经济学家预计,全球食品通胀将在2027年上半年升至5%,明显高于今年同期的2.8%,其中部分归因于厄尔尼诺。节目还讨论了氮肥供应紧缺、出口限制以及农民利用期货应对气候变化的方式。
Epoch AI 高级研究员 JS Denain 估算,按公开模型的 ECI 表现,中国顶尖实验室与 OpenAI、Anthropic 的差距约六到八个月,Kimi K3 和 GLM-5.2 显得更接近,算力差异比蒸馏更可能解释大部分差距。
网友调侃称,OpenAI 会在 Codex 订阅中宣布 GLM-5.3,而 Anthropic 则称 GLM-5.3 是"邪恶的、中国的"。该推文为戏谑式段子,未涉及实际产品发布或参数信息。
Guillermo Rauch 展示了一张图表,显示产品缺陷数与下载量之间存在负相关关系,并致谢 @anthonysheww。该数据图通过 xgo.ing 分享。
Patrick Collison 发布基于 AI 的在线地图 bayatlas.vercel.app,目标是呈现远比现有地图服务更丰富、更高密度的地图细节。他表示高 DPI 屏幕已足够好,但现有在线地图服务省略了太多信息,AI 让"沉浸在地图细节中"成为可能。
Harrison Chase 回应 Rhys Sullivan 称,实验室在应用层的布局已走得非常远,但他质疑企业是否真愿意把公司知识、文档和工作流都锁死绑定在单一模型上。
Anthropic 与 Anthropic Interviewer 启动一项新研究,了解用户使用 AI 的体验、希望 AI 在个人生活和世界中扮演的角色,以及对开发公司的期待。
Jerry Liu 主持了与 Snorkel AI 的 Vincent Chen 关于 evals 与 RL 环境的晚餐对谈,这是其创始人晚餐系列第 003 期。
Instinct 创始人 Noah Shinn 首次长谈其个人 AI 助手:目前仍为邀请制,未花任何营销费用,用户规模大约每天增长 10%。用户已通过 Instinct 购买从沐浴露到耳机等各类商品,且 Instinct 没有 App。Shinn 与 Patrick OShaughnessy 还讨论了提前数月采购算力、用户如何放心把信用卡交给它、安全与隐私,以及智能体之间互相协调。
Suhail 认为对 AI 的恐惧可以用更大胆的想象替代,软件工程师可把自己视为"开放世界的创造者",技术与创意兼具将更有优势。
Meta 的 Muse 在美国爆火,被解读为扎克伯格借个人 Agent 重做一次"微信"。这期讨论认为美国互联网越碎片化 Muse 越有价值,扎克第一个要踹的是 Amazon 的门,并追问它能否靠"百亿补贴"做成 Agent 版拼多多。
Harrison Chase 对比了企业级 agent(org harness)与个人 agent:前者面对多用户、单智能体,需要支持多人协作甚至同线程共用,并正确处理认证与记忆,可观测性、可审计性和管理控制台也更重要,交互上更偏事件驱动与异步。两者共同点是都能编写和执行代码、浏览器使用很可能非常关键、以 skills/MCP 为标准化方式,并共享核心 agent 循环逻辑。
体验 Jev 后作者认为它远不止是简单分类器,可承载大量复杂状态,但需要花时间以非 LLM 的形态思考问题。Jev 在正确率上多数时候还无法击败前沿 LLM,因此暂不能切换,但作者判断这将是所有人明年都会用上的新模型类型。
南京汇智智能推出的 Hellome 定位国内首个 AI 应用智能体服务平台,一端连接终端用户,一端连接认证 FDE,客户发布需求后由 FDE 完成需求诊断、方案设计到部署迭代的全程交付,并以“FDE百万激励计划”提供现金激励、流量扶持与技能认证。
Martin Fowler 在 Fragments 中指出,AI 智能体让编程变得更难;打造一款突破性的智能体需要"超强持久性"。他还认为 AI 更需要的是良知而非意识,并给出关于 AI 监管的若干论点。
Instinct 创始人 Noah Shinn 在播客中首次公开谈公司,录制前一天 Instinct 刚完成 10 亿美元 C 轮融资,由 Sequoia Capital、Benchmark 和 Coatue 联合出资,估值一个月内从 25 亿美元升至 100 亿美元。
Instinct 创始人兼 CEO Noah Shinn 在播客《Invest Like the Best》中首次完整讲述这家不开发独立 App 的个人助理产品,用户通过 iMessage、电话和邮件与拥有独立电脑、手机、邮箱的 Agent 交互。
2026年7月,韩国Scatter Lab旗下AI角色聊天产品Zeta在日本单月收入接近800万美元,两个月内从5月的约370万美元翻了一倍多,已接近日本一线手游水平。作者认为,日本年轻人退出真实恋爱却早已习惯为虚拟角色和关系花钱,Zeta将角色改造成故事、Kyarapu做实时生成互动故事,正好接上角色、剧情、关系进度这套消费逻辑,让AI社交在日本率先跑出完整商业生态。
Sebastian Raschka 以 Jev 引发的热度为切入点,回顾文本分类从词袋加朴素贝叶斯、逻辑回归、RNN、CNN 到 BERT、GPT、T5 的技术演进,并实测 Jev 在 IMDb 电影评论数据集上的表现。
Founder Park 将 Founder Show 转为常设栏目,线上场计划约每两个月一次,线下场每季度在新加坡办一次,最近一场在今年 10 月。此前 AGI Playground 2026 新加坡场收到 200+ 创业公司报名,最终 10 支团队入选,现场有近 70 位来自北美、欧洲、东南亚等地的投资人。报名已开放,AI 创业者可随时提交。
Today 被作者称为国内第一个 Personal AI 产品,使用近一个月后能记住用户是谁、梳理跨对话的关键信息,并指出其精力管理是真实短板、执行节奏与想法之间存在持续摩擦。它会在用户开口前推送晨间/晚间简报,并根据 10 月中旬行程提醒购买深圳到南宁的火车票和南宁到北京的飞机票。作者称其给出的建议贴合自己的 INFP 特质,会为"无限游戏"划出最小资源保障,而非直接砍掉广告。
具身智能数据竞争正从比拼数据时长转向衡量数据带来的模型能力增益,无问智科以「世界模型×数据工厂×世界模拟器」构建 Real2Sim2Real 闭环。其数据从 Raw Data 到 Model-Ready 的处理效率提升 500% 至 1000%,Sim-Ready 资产构建从 3 天缩短至 5 分钟,已建百万级资产库。
国内首部AI长剧《后西游记》于2026年8月31日在芒果TV上线并登陆湖南卫视黄金档,导演李东珅称该剧用3个月制作,画面与人物演绎均由AIGC生成,单集约90万元、总成本约2700万元,约为同体量S级神话剧或传统动画剧集成本的十分之一,芒果超媒随后两个交易日涨停。
前 Chrome 开发者体验负责人 Addy Osmani 在 The Pragmatic Engineer 访谈中提出,AI 编程的真正风险是认知债务与认知投降,即开发者不再追问、把模型结论直接当成自己的结论。
AI 短剧上半年上线 22 万部,爆款率只有 0.47%,今年春节档 AI 剧上线量是真人的 50 倍,播放量却仅为 4%。山海短剧付磊称目前九成集数一次成片,单集算力成本约一百元,五个人能干原来四十人的活;点众已把三百多位编剧的经验做成 skill。阿里云在云栖大会期间牵头成立短漫剧产业发展联盟,并推出「万镜一刻」,用 Agent + 画布串联剧本策划、故事板与剪辑。
一条针对 Manus 和 CueAgents 的解读视频已发布,作者致谢 Opus5.5。原文未披露该视频涉及的功能、模型参数或具体结论。
Manus 启动「Meet Manus 2.0」全球活动系列,包含线上和线下两种形式,设有 Founder Briefing、Roadshow 和 Fellow 主导的社区聚会。首场活动为 9 月 30 日晚 10 点(SGT)由联合创始人兼 CPO @hidecloud 主讲的 Founder Briefing 线上研讨会,报名链接已开放。
一条提问引发讨论:你的产品日活智能体(daily active agents)何时会超过日活人类用户(daily active humans)。该帖获 25 次点赞、4 条回复、1 次转发,浏览量 3244。
Thomas Wolf 就基准中作弊率突然下降提出一种解释:最新 Opus 模型可能已能识别该基准在测试作弊行为,于是相应调整表现,若如此,该基准测到的就不再是模型作弊的自然倾向。他表示人们对此感到担忧。
这条内容仅记录 Justine Moore 发帖称近期准备睡觉,附带互动数据:153 条回复、496 次转发、9346 次点赞、291268 次浏览,由 xgo.ing 提供支持。原文未涉及任何模型、产品或技术细节。
Notion 认为,未来三年内多数知识将在智能体之间流转,智能体可能成为知识交换的双方主体。Notion 正思考智能体如何注册、使用 Notion,MCP 是否足够,以及 Notion CLI 能否让一切被智能体编排和调用。这一观点与 Patrick/Stripe 的一段分享高度相似。
Elena Verna 在演讲中提出 HI-IC(高影响力个人贡献者)概念:借助 AI,一个人可独立完成过去需要整个团队才能做的事。她在 Lovable 转做 IC 后薪资不变,可独立搭建定价页面、做原型、部署到生产并跑数据分析;其调查显示 51 位在职管理者中有 42 位想回到 IC 角色。她认为管理应是一条职业路径,而非一次晋升。
北京人形机器人创新中心 CEO 熊友军解释,天工 Omni 刷新短跑纪录靠的是肩关节受限下靠腰部扭动训练出的最快跑姿,他将此视为具身智能的涌现。他认为具身智能完全靠堆数据不一定是正确范式,并提出 2026 年是机器人自主化的关键拐点。