Suhail 与 dax 讨论:更偏爱"超级智能"而非"AI"的说法
Suhail 转发 dax(@thdxr)的推文并表示,相比"AI"这个词,自己其实更喜欢"超级智能"(superintelligence)的说法。该推文获 45 次点赞、约 1.6 万次浏览。
Suhail 转发 dax(@thdxr)的推文并表示,相比"AI"这个词,自己其实更喜欢"超级智能"(superintelligence)的说法。该推文获 45 次点赞、约 1.6 万次浏览。
Akshay Kothari 称赞 Tibo 及其团队真正在意生态,是优秀的合作伙伴,始终想着把蛋糕做大。Tibo 认为 ChatGPT 上的插件发现带来巨大的采用机会,开放生态终将胜出。
OpenAI 发布 dots,personal agent 赛道变得比办公赛道更拥挤。GPT 6.1 Sol 发布后缓存降价 50%,但 Claude 的 sonnet 5.5 跑分已超过 astra,而 6.1 Astra 因安全原因未放出。作者还提到 jev 一周估值达 100 亿美金,头部世界模型公司以 80 亿美金出售。
银行正面临协同 AI 智能体集群带来的新型网络安全风险:自主智能体可同时探测多条路径、共享信息并动态调整行为。防御的关键在于把日志、指标、链路追踪、安全事件与身份数据关联起来,借助搜索与可观测性识别单个事件看似合法、组合起来才暴露的异常模式。SOC 需以 AI 辅助调查与响应应对机器速度的攻击,同时对自身 AI 智能体的行为保留权限控制与人工问责。
Replit 认为 Sutton 的"苦涩教训"正在冲击 harness 设计:明天的模型不应继承我们为昨天的模型所构建的每一项变通方案,这才是适应之道。相关内容已发布在其博客。
Replit 称模型持续变聪明,但 harness 不会消失,其职责从替模型做决定转为给模型提供选项。在 Replit Agent 中,主智能体决定何时更深入思考、何时把工作交给子智能体,以及子智能体应投入多少工作量。
personal agent 每切换一次就是一次隐私的大暴露,不同于 coding 和 working agent 切换成本不高。这类产品的独占性因此进一步提高,且高度集中在巨头手里,作者认为人类社会未来会更加集中、更加垄断。
有人称 jev 这类产品毫无壁垒,但其估值一周内达到 100 亿美金;而被炒作半年的世界模型赛道,头部公司以 80 亿美金出售。发帖者借此感叹世界没有对错,也没有谁是傻子。
产品开发者刘小排通过自己常去的两家理发店的对比,指出AI写代码越来越快、做产品门槛越来越低,但真诚仍无法被取代。他描述" S造型"老板记得他半年没来、仍记得他常和同事一起来,而高端连锁"M理容馆"服务人员情绪价值拉满却只是公式化推销办卡。他由此类比产品:有的产品华丽却充满套路,有的产品朴素却由创始人亲自与用户沟通,并以Flomo、早期的沉浸式翻译为例。
软件架构演化被概括为单体→原始分布式→SOA→微服务→云原生,其中SOA的ESB虽是解耦一步却在故障隔离上倒退,因此互联网公司普遍弃用。文章指出解耦粒度细化与故障域隔离强化是两条主线,理念已从追求零故障转向设计容错性。AI Agent 打破云原生无状态前提,带来不确定性、状态管理、动态编排与可观测性四重挑战。
硅谷101播客邀请资深大宗商品期货交易员张思齐,解析这场50年来罕见的超级厄尔尼诺如何影响棕榈油、天然橡胶、咖啡豆等农产品供给。摩根大通经济学家预计,全球食品通胀将在2027年上半年升至5%,明显高于今年同期的2.8%,其中部分归因于厄尔尼诺。节目还讨论了氮肥供应紧缺、出口限制以及农民利用期货应对气候变化的方式。
Higgsfield 创始人兼 CEO Alex Mashrabov 在 20VC 播客中透露,公司内部每月使用模型的花费超过 400 万美元,近 400 名团队成员平均每月在模型上花费超过 1 万美元。
Epoch AI 高级研究员 JS Denain 估算,按公开模型的 ECI 表现,中国顶尖实验室与 OpenAI、Anthropic 的差距约六到八个月,Kimi K3 和 GLM-5.2 显得更接近,算力差异比蒸馏更可能解释大部分差距。
网友调侃称,OpenAI 会在 Codex 订阅中宣布 GLM-5.3,而 Anthropic 则称 GLM-5.3 是"邪恶的、中国的"。该推文为戏谑式段子,未涉及实际产品发布或参数信息。
Guillermo Rauch 展示了一张图表,显示产品缺陷数与下载量之间存在负相关关系,并致谢 @anthonysheww。该数据图通过 xgo.ing 分享。
Justine Moore 表示自己把一段 Dario 讲话的视频片段看了五遍,因为 Dario 说话时的表情变化非常丰富,她称"真的太精彩了"。该帖获得 2587 个点赞、105 次转发和 75 条回复,浏览量约 709176。
LangChain 的 Harrison Chase 引用 @pirroh 的文章指出,随着模型变强,harness 不会消失,而是从「决定」转向「提供」。在 deepagents 中,每个 subagent 拥有各自的模型、工具和权限,主循环只负责决定生成哪个 subagent 以及何时生成。
Patrick Collison 发布基于 AI 的在线地图 bayatlas.vercel.app,目标是呈现远比现有地图服务更丰富、更高密度的地图细节。他表示高 DPI 屏幕已足够好,但现有在线地图服务省略了太多信息,AI 让"沉浸在地图细节中"成为可能。
Harrison Chase 回应 Rhys Sullivan 称,实验室在应用层的布局已走得非常远,但他质疑企业是否真愿意把公司知识、文档和工作流都锁死绑定在单一模型上。
Thomas Wolf 发布了一条仅含「GPT 6.1 duck」的推文,互动数据为 3 条回复、3 次转发、122 次点赞、6988 次浏览与 14 次数据分析。该推文由 xgo.ing 提供支持。
Sam Altman 表示 Ultrafast 的速度快到让他"再也不想回到过去"。该帖获得 12063 次点赞、1352 条回复和 279 次转发。原文未透露 Ultrafast 的具体功能、所属产品或性能数据。
Guillermo Rauch 发布推文"This is just… beautiful",配文附带互动数据:58 条回复、19 次转发、1229 次点赞、140077 次浏览,由 xgo.ing 提供支持。
Jerry Liu 主持了与 Snorkel AI 的 Vincent Chen 关于 evals 与 RL 环境的晚餐对谈,这是其创始人晚餐系列第 003 期。
Akshay Kothari 在推文中引用《纽约时报》文章称,现场有一位创始人穿搭出众、值得效仿,并称其为 @Muse。原文未提供更多细节。
Perplexity 称 AI 安全与智能体治理是工程问题,已在其基础设施、harness 和工具中内置安全防护,并应用到各产品中。该公司分享了如何通过工程手段打造更安全的智能体,详情见其官方博客。
Ray Dalio 认为,评估一个人不应以简历上的技能为优先,正确的顺序是价值观、能力、技能,技能其实最不重要,因为只要能力到位,技能总能适应。该观点引自 Sam Parr、Shaan Puri 与 @myfirstmilpod,并带有 #Principles、#Leadership、#Hiring 标签。
Perplexity 称智能体治理本质是工程问题,已把安全防护机制内建到自家基础设施、harness 和工具中,并在各产品线上投入使用。该公司同时发布博客,介绍其工程化构建更安全智能体的具体做法。
Instinct 创始人 Noah Shinn 首次长谈其个人 AI 助手:目前仍为邀请制,未花任何营销费用,用户规模大约每天增长 10%。用户已通过 Instinct 购买从沐浴露到耳机等各类商品,且 Instinct 没有 App。Shinn 与 Patrick OShaughnessy 还讨论了提前数月采购算力、用户如何放心把信用卡交给它、安全与隐私,以及智能体之间互相协调。
Suhail 认为对 AI 的恐惧可以用更大胆的想象替代,软件工程师可把自己视为"开放世界的创造者",技术与创意兼具将更有优势。
Meta 的 Muse 在美国爆火,被解读为扎克伯格借个人 Agent 重做一次"微信"。这期讨论认为美国互联网越碎片化 Muse 越有价值,扎克第一个要踹的是 Amazon 的门,并追问它能否靠"百亿补贴"做成 Agent 版拼多多。
Harrison Chase 对比了企业级 agent(org harness)与个人 agent:前者面对多用户、单智能体,需要支持多人协作甚至同线程共用,并正确处理认证与记忆,可观测性、可审计性和管理控制台也更重要,交互上更偏事件驱动与异步。两者共同点是都能编写和执行代码、浏览器使用很可能非常关键、以 skills/MCP 为标准化方式,并共享核心 agent 循环逻辑。
体验 Jev 后作者认为它远不止是简单分类器,可承载大量复杂状态,但需要花时间以非 LLM 的形态思考问题。Jev 在正确率上多数时候还无法击败前沿 LLM,因此暂不能切换,但作者判断这将是所有人明年都会用上的新模型类型。
Martin Fowler 提出「Sensible Defaults」(合理默认做法)理念:团队应当遵循这些默认实践,或者做得更好,但必须准备好解释为什么选择其他方式。该观点发布于 martinfowler.com。
hidecloud 分享了自己办公室附近最喜欢的餐厅,配文带眨眼表情。该帖获 19 个点赞、1 条回复,浏览量 4418,由 xgo.ing 提供支持。
南京汇智智能推出的 Hellome 定位国内首个 AI 应用智能体服务平台,一端连接终端用户,一端连接认证 FDE,客户发布需求后由 FDE 完成需求诊断、方案设计到部署迭代的全程交付,并以“FDE百万激励计划”提供现金激励、流量扶持与技能认证。
Martin Fowler 在 Fragments 中指出,AI 智能体让编程变得更难;打造一款突破性的智能体需要"超强持久性"。他还认为 AI 更需要的是良知而非意识,并给出关于 AI 监管的若干论点。
Instinct 创始人兼 CEO Noah Shinn 在播客《Invest Like the Best》中首次完整讲述这家不开发独立 App 的个人助理产品,用户通过 iMessage、电话和邮件与拥有独立电脑、手机、邮箱的 Agent 交互。
Sebastian Raschka 以 Jev 引发的热度为切入点,回顾文本分类从词袋加朴素贝叶斯、逻辑回归、RNN、CNN 到 BERT、GPT、T5 的技术演进,并实测 Jev 在 IMDb 电影评论数据集上的表现。
国内首部AI长剧《后西游记》于2026年8月31日在芒果TV上线并登陆湖南卫视黄金档,导演李东珅称该剧用3个月制作,画面与人物演绎均由AIGC生成,单集约90万元、总成本约2700万元,约为同体量S级神话剧或传统动画剧集成本的十分之一,芒果超媒随后两个交易日涨停。
前 Chrome 开发者体验负责人 Addy Osmani 在 The Pragmatic Engineer 访谈中提出,AI 编程的真正风险是认知债务与认知投降,即开发者不再追问、把模型结论直接当成自己的结论。