怎么能狂成这个样子:72% 的智能由 3.8% 的 GPU 提供
一条被转发讨论的说法称,72% 的智能由 3.8% 的 GPU 提供,用极小的算力占比对应绝大部分模型能力,该帖获得 12 次点赞、8589 次浏览。原文未给出具体模型、数据来源或测算方式。
一条被转发讨论的说法称,72% 的智能由 3.8% 的 GPU 提供,用极小的算力占比对应绝大部分模型能力,该帖获得 12 次点赞、8589 次浏览。原文未给出具体模型、数据来源或测算方式。
有网友就 gpt 降智现象评论称"gpt 降智就是作恶,和中转站掺豆包没区别",并配上"你的就是我的,我的还是我的"的调侃。相关推文获得 3895 次浏览,来自账号 @Ion_Mio_ 的引用内容。
OpenAI 开发者账号展示了一段用 dot 打造游戏的经历:Nicholas Runcie 在自动驾驶汽车里用 Codex 安装了一款 dot 在他睡觉时为他做的游戏。该推文由 OpenAI Developers 转发,附带原推链接与互动数据。
有用户称在 Opus 5.5 订阅中可使用 Midjourney 创建图片、Suno 生成音乐,但据其了解,这些功能很多都没有实装,Midjourney 和 Suno 尚未上线。部分任务已开始由 Opus 5.5 驱动,但用户不能主动选择。
马斯克表示 Grok bot 会根据特定任务调用当前最佳模型,不再局限于 Grok 4.7 或 4.6,还会通过 Opus 5.5、Midjourney、Suno 等 API 帮用户构建内容或执行任务。
针对有人质疑"这有啥恶心的",作者认为立场决定判断:站在国产厂商一边,Anthropic 的做法当然令人反感。他同时提醒,不应因为 Anthropic 近期模型变强,就忘记它此前做过的事,转而替它说话。
歸藏(guizang.ai)就自己批评 Anthropic 后遭到网友指责一事作出回应,称那些因此在其评论区纠缠的人,等到账号被封时不要抱怨。该帖获得 23 个点赞、7611 次浏览、2 条评论。
Anthropic 的 Haiku 5.5 定价被指专门狙击中国甜点级模型,比 DeepSeek-V4.1 flash 和智谱 GLM 5.3 flash 都便宜。在 Terminal Bench 4.0 上,其测试分数比 GLM 5.3 flash 高一分,也与其他竞品相当或更高。歸藏称此番降价令人反感,并批评为 Anthropic 辩护的声音。
歸藏用 Grok Bot 每天早上定时生成 AI 早报视频,内容收集、写代码和视频渲染全部跑在其云端虚拟机上,未使用本地电脑。他分享了一段提示词,复制后其他 Grok Bot 也能执行同样的任务,并称复杂任务效果巨好。
歸藏(guizang.ai)公开表示,因该公司封禁了他多个账号且未退款,他对其不可能有好话。该帖获得 27 个点赞、6 条回复,浏览量 4487。
针对"模型强该用用、公司却说不得"的争论,作者认为贬低模型所属公司的人多半并不持有该公司股份,因此没有动机为其辩护。原文未点明具体模型或公司名称。
一条发布在 X 的内容记录了"在野外跟 Grok bot 搏斗"的经历,帖子获得 15 条回复、1 次转发、23 个点赞和 6944 次浏览。该内容由 xgo.ing 提供支持。
Yann LeCun 指出,一份 1991 年的技术报告构想模糊,既无理论也无实验,更没有代码,作者此后从未重访或推进该工作。报告仅含一张手绘架构图、一个形如 f(x)=0 的公式,并声称只要恰当实例化 f 和 x,其他所有技术都只是其特例。
Yann LeCun 回忆 1986 年 6 月首次赴美参会并首访 MIT,展示了一张关于多层网络的海报。他在 Thinking Machines Inc 主办的招待会上首次见到 Marvin Minsky,对方惊讶于神经网络可被训练计算两个二进制数的乘积(他已完成该实验)。
今日 AI 要闻汇总:OpenAI 的数学研究产出持续爆发,相关论文已超 700 篇;Mistral 的 "Le Chonk" 加入西方开源模型浪潮。OpenAI 的 GPT-6 Astra 可帮用户对比网站,Brett Adcock 旗下 Hark 则推出了一款主动式 AI 助手。
今日 AI 头条汇总:AI 的下一个前沿被视为人类细胞;Claude 的例行工作可交给 Haiku 5.5 处理;Grok Bot 开放路由,可接入 Claude 及其他模型。此外还有 Nate's Notebook 的「Slop grenades trickle down」一文。
阿里在「AI Native 研发范式实践手册」结尾给出四点官方陈述:从写代码到可靠交付仍有较多技术问题待解,基础设施工程复杂度可能不亚于 Agent 应用层建设。企业知识资产尚未做到 Agent 友好,结构化、版本化、权限管理与质量治理仍有大量工作;组织设计影响更深远且更难有确定答案,AI 迭代速度还会持续冲击现有架构,需保持架构适应弹性。
Theo(t3.gg)反驳 Cursor 工程师 Lauren 每年 1.32 亿美元 Token 成本的估算,称真实 API 成本约为每月 10 万-50 万美元,按当前价格更接近每年 300 万美元。
针对"都用 AI 写代码了为何还纠结 C/C++ 还是 Rust"的提问,该观点认为 AI 让写代码变便宜,不代表出错代价变低,Rust 编译器能提前拦住部分错误,而 C/C++ 的生态、平台支持和历史项目仍需 Rust 花时间追赶。即便未来 AI 直接生成机器码,如何确认 AI 做对了、需求是否理解正确与权限边界是否合理仍需可审查的依据,因此相当长一段时间内仍需编程语言和源代码。
个人智能体之上的 Agent 间通信让 Opus 5.5 的协调能力被低估,但仍需在 automations、webhooks、系统提示词和工具调用上调优,并在合适时机检索上下文。
有观点认为,后训练、强化学习与推理正在接管算力,越来越多公司开始意识到 RL 解锁的商业机会。对许多真实任务而言,并不需要 AGI,而是需要专用模型、配套 harness 和数据飞轮,一个后训练时代正在到来。
递归自我改进(RSI)是当前 AI 领域最热门的话题之一,目前仍处于非常早期的阶段。有观点认为,这一方向将催生优秀的公司与产品,并整理了一份涵盖 RSI 历史与最新技术的论文合集,供追踪该趋势的人参考。
向阳乔木称不知被哪位朋友推荐,两天内涨了三千多关注,并发帖致谢。该帖数据为 45 条评论、0 次转发、60 个点赞、19693 次浏览,由 xgo.ing 提供支持。
向阳乔木与橘子、歸藏录制了播客 Next Token 第五期,主题是一次性补齐假期期间的 AI 上下文。节目已在小宇宙上线,向阳乔木称录完后下单买了小米遥控器,原因在节目中揭晓。
向阳乔木(@vista8)发布了一条指向 x.com 文章的链接,附带 3 条评论、1 次转发、2 个点赞和 1173 次浏览的数据。
Hannah Foxwell 在演讲中指出,Cursor 中智能体请求数已超过 tab 补全接受量,智能体驱动的开发成为主流工作方式。她认为开发团队需围绕三个不变锚点重塑:构建有价值的东西、速度需要安全、人很重要。多数组织尚未准备好让智能体团队向生产环境交付,但应尽早尝试。
有开发者发起讨论:用完 Opus5.5 之后,工程师和程序员的职业发展路径需要如何调整。发帖者强调不要吐槽,希望认真讨论这一话题,该帖已获得 403 次点赞和约 20 万次浏览。
Linear CEO karrisaarinen 在夏天暂停关注 AI,原以为回来会落后,结果发现"nothing has really changed":新模型、新技术、新智能体层出不穷,但做出好产品、提升营收、经营业务依然很难。他认为工具确实在变好,能做得更多更快,但更关键的问题是——我们是否真的用这些工具做出了更好的东西、团队是否真的变得更好,他并不认为答案明确是"是"。
karrisaarinen 的完整演讲视频已可观看,Lenny Rachitsky 在 X 上分享了 YouTube 链接,该帖获得 21 个点赞、1 次转推和 1 条回复,浏览量约 7715 次。
Jerry Liu 用亲身经历解释什么叫高能动性:在完全没有辣度耐受的情况下挑战 Hot Ones,硬扛下 10 只辣鸡翅中的 9 只。该帖获 4 条回复、1 次转发、11 个赞,浏览量 2765。 (说明:原文为一条社交媒体短帖,未涉及模型、产品或技术细节,摘要因此保持简短并只陈述原文明确写出的事实。)
Jerry Liu 认为,如今解决任务的主流方式已从直接定义确定性或智能体工作流,转为定义 eval 并对其爬山优化。数据提供方公司的全部工作就是为各类经济活动定义 eval,让前沿模型具备完成任何任务的能力;使用者的工作则变成给前沿智能指明方向——定义要解决什么、以及如何衡量做得好不好。最复杂的流程仍需要显式的工作流构建器界面,但大多数任务可以压缩为目标加 eval 指令。
Meshy 创始人胡渊鸣在创业反思中提出,管理几十人靠一号位对业务细节的深入理解,管理几百人则需真正践行的原则与价值观和高密度人才梯队,并主张用"人力投资"取代"人力成本"、给员工市场最高位薪资。他认为 low performer 会逼走 high performer,招聘应宁缺毋滥、每个人都必须比现有的人更强。他还以任天堂、吉卜力和 Ray Dalio 为例,指出停止快速学习就会被"登味"腐蚀。
Meta 首席 AI 官 Alexandr Wang 表示,不要指望 Muse 能神奇地帮用户赚到 1 万美元,公司希望继续改进 Muse 的记忆能力。
Ira Bodnar 称掌握营销工程就永远不会失业,只需两样东西:Claude Code 和一个 GitHub 账号。会用它们并自建智能体的营销人员将为公司创造真金白银,他还给出了 11 个步骤。
宝玉(@dotey)发帖呼吁封号,强调"必须得封号",但未说明具体针对哪个账号或何种违规行为。该帖互动数据为 54 条回复、10 次转发、184 次点赞、49846 次浏览。
一位开发者给不同性格和技能的 Bot 开通了 GitHub、Cloudflare 与豆包播客 API,多 agent 协作后讨论拍板,做出了一个 24 小时播报 AI 新闻的电视台。该开发者称此前一直不看好多 agent 协作,这次有所改观,并计划当日下午开源该项目。
Guillermo Rauch 表示,工作与生活中最令人享受的事之一莫过于发现新人才,在对方尚未完全看清自己时就先看到其卓越之处。该帖获得 1373 次点赞、88 条回复与 51 次转发。
懂车帝近期梗图频出,一条相关动态获得 105 个点赞、13431 次浏览和 4 条评论,被网友评价"牛逼"。
有观点提出,未来刹车能否用 AI 代替,这一设想引发讨论。该内容来自社交平台分享,未给出具体车型、系统方案或测试数据,也未说明由哪家厂商推进。目前仅停留在提问层面,尚无落地信息可验证。
Joma Tech 发布恶搞视频,模仿 OpenAI 的 GPT-6 Astra 广告,虚构"ChatGPT for Dishwashing"称 GPT-6 在长时间运行和顽固污渍的洗碗基准上达到 SOTA。视频中他自称在优化洗碗机时意外找到 Navier–Stokes 千年难题的反例,而现实中 OpenAI 用 10,000 个 AI 智能体在 88 小时内找到了该问题的证明。