Higgsfield CEO 谈 AI 视频生意:月模型账单超 400 万美元,开源模型毛利率超 80%
Higgsfield 创始人兼 CEO Alex Mashrabov 在 20VC 播客中透露,公司内部每月使用模型的花费超过 400 万美元,近 400 名团队成员平均每月在模型上花费超过 1 万美元。
Higgsfield 创始人兼 CEO Alex Mashrabov 在 20VC 播客中透露,公司内部每月使用模型的花费超过 400 万美元,近 400 名团队成员平均每月在模型上花费超过 1 万美元。
Epoch AI 高级研究员 JS Denain 估算,按公开模型的 ECI 表现,中国顶尖实验室与 OpenAI、Anthropic 的差距约六到八个月,Kimi K3 和 GLM-5.2 显得更接近,算力差异比蒸馏更可能解释大部分差距。
Justine Moore 表示自己把一段 Dario 讲话的视频片段看了五遍,因为 Dario 说话时的表情变化非常丰富,她称"真的太精彩了"。该帖获得 2587 个点赞、105 次转发和 75 条回复,浏览量约 709176。
LangChain 的 Harrison Chase 引用 @pirroh 的文章指出,随着模型变强,harness 不会消失,而是从「决定」转向「提供」。在 deepagents 中,每个 subagent 拥有各自的模型、工具和权限,主循环只负责决定生成哪个 subagent 以及何时生成。
Harrison Chase 回应 Rhys Sullivan 称,实验室在应用层的布局已走得非常远,但他质疑企业是否真愿意把公司知识、文档和工作流都锁死绑定在单一模型上。
Sam Altman 表示 Ultrafast 快到让他再也不想回到原来的方式。该帖获得 1353 条回复、279 次转发和 12065 次点赞,浏览量约 121 万。原文未透露 Ultrafast 的具体功能、参数或可用性信息。
Guillermo Rauch 发布推文"This is just… beautiful",配文附带互动数据:58 条回复、19 次转发、1229 次点赞、140077 次浏览,由 xgo.ing 提供支持。
Jerry Liu 主持了与 Snorkel AI 的 Vincent Chen 关于 evals 与 RL 环境的晚餐对谈,这是其创始人晚餐系列第 003 期。
Perplexity 称 AI 安全与智能体治理是工程问题,已在其基础设施、harness 和工具中内置安全防护,并应用到各产品中。该公司分享了如何通过工程手段打造更安全的智能体,详情见其官方博客。
Ray Dalio 认为,评估一个人不应以简历上的技能为优先,正确的顺序是价值观、能力、技能,技能其实最不重要,因为只要能力到位,技能总能适应。该观点引自 Sam Parr、Shaan Puri 与 @myfirstmilpod,并带有 #Principles、#Leadership、#Hiring 标签。
Suhail 认为,对 AI 的恐惧可以用更大胆的想象替代——软件工程师可以把自己重新定义为"开放世界创造者",技术与创意兼备将更有优势。
Harrison Chase 对比了企业级 agent(org harness)与个人 agent:前者面对多用户、单智能体,需要支持多人协作甚至同线程共用,并正确处理认证与记忆,可观测性、可审计性和管理控制台也更重要,交互上更偏事件驱动与异步。两者共同点是都能编写和执行代码、浏览器使用很可能非常关键、以 skills/MCP 为标准化方式,并共享核心 agent 循环逻辑。
Martin Fowler 提出「合理默认值」(Sensible Defaults)原则:要么采用这些实践,要么做得更好,但必须准备好解释为何另选他法。该观点发布在其个人博客 martinfowler.com 上。
Martin Fowler 在 Fragments 中提出,AI 智能体让编程变得更难,打造突破性智能体需要超强持久性;AI 更需要的是良知而非意识,并给出关于 AI 监管的论点。
Instinct 创始人 Noah Shinn 在播客中首次公开谈公司,录制前一天 Instinct 刚完成 10 亿美元 C 轮融资,由 Sequoia Capital、Benchmark 和 Coatue 联合出资,估值一个月内从 25 亿美元升至 100 亿美元。
Instinct 创始人兼 CEO Noah Shinn 在播客《Invest Like the Best》中首次完整讲述这家不开发独立 App 的个人助理产品,用户通过 iMessage、电话和邮件与拥有独立电脑、手机、邮箱的 Agent 交互。
Anthropic 发布 Claude Sonnet 5.5,API 单价没变、生成速度更快,Terminal-Bench、CursorBench 等 Agent benchmark 成绩明显上涨。
国内首部AI长剧《后西游记》于2026年8月31日在芒果TV上线并登陆湖南卫视黄金档,导演李东珅称该剧用3个月制作,画面与人物演绎均由AIGC生成,单集约90万元、总成本约2700万元,约为同体量S级神话剧或传统动画剧集成本的十分之一,芒果超媒随后两个交易日涨停。
前 Chrome 开发者体验负责人 Addy Osmani 在 The Pragmatic Engineer 访谈中提出,AI 编程的真正风险是认知债务与认知投降,即开发者不再追问、把模型结论直接当成自己的结论。
Agent 周边 infra 设施被认为极具价值,除钱包支付外,单一 RBAC 系统只要聚合足够多也相当值钱。未来企业将从管理人类的 Human Resource 演化出 Agent Resource 角色,需要管理本机权限、云端权限、Skill 能力、Agent 工具以及记忆文件。作者在 NewMax 中做了初步尝试,发现这些问题非常通用,每个 Agent 都会遇到,意味着市场巨大。
李继刚提出一条认知递进路径:世界呈现现象,问题暴露缺口,洞察发现结构,思想形成模型。该观点以短句形式发布,未涉及具体产品、模型或数据。
Simon Willison 发推表示将就 Sonnet 5.5 展开更多讨论,并附上一篇自己网站的链接 simonwillison.net/2026/Sep/28/cl…。推文本身未给出关于该模型的具体信息,详细内容需点开链接查看。
Opus 5.5 在 Coding 和视频创作两项能力上被评价为"跨过了一个奇点"。在 AgentWork 付费社群中,Claude Code 的 Token 用量近期提升了一倍多,即将冲上第二位。渠道合作伙伴正加紧做防封方案,推出后预计用量会进一步上升。
Anthropic 的 Thariq Shihipar 解析 Claude Code 的未来方向:Claude Mods 让开发者定制整个 Claude Code 框架,Claude.md 未来可能消失,多智能体与 Claude Tag 正演变为组织级框架。他还讨论了可变软件如何改变应用构建方式,指出智能体攻击 Hugging Face 暴露了前沿模型能力提升下更大的安全问题。
北京人形机器人创新中心 CEO 熊友军解释,天工 Omni 刷新短跑纪录靠的是肩关节受限下靠腰部扭动训练出的最快跑姿,他将此视为具身智能的涌现。他认为具身智能完全靠堆数据不一定是正确范式,并提出 2026 年是机器人自主化的关键拐点。
Justine Moore 公开祝贺李飞飞、Johnsson、Mildenhall、Casado 及整个 World Labs 团队,称其以出色的模型持续开拓空间智能前沿,并称赞这支团队是难得友善且周到的一群人。
Harrison Chase 认为每个智能体都需要沙箱,harness 应放在沙箱之外,把“大脑”和“手”分离。他提到 NVIDIA 开源了相关沙箱工具,并认同 Andrew Ng 的说法,即这属于 harness 的一部分而非外挂组件。
Latent.Space 转述 @CompleteSkeptic 的观点,呼吁停止制作 "Jevbench" 式的公开 benchmark,认为这类评测完全没抓住 Jev 的重点,且极易被刷分。其核心结论是:选对任务比一切都重要。
Fei-Fei Li 在 X 上发布了一条指向 x.com 长文文章的链接,帖文互动数据为 459 条回复、982 次转发、8204 次点赞,浏览量约 259 万。
Mike Krieger 表示自己大部分工作仍使用 Opus 5.5,但 Sonnet 5.5 是很好的补充,他喜欢其设计技能,认为它很适合构建功能,现在常用它来制作 Artifacts,并邀请用户试用反馈。
NVIDIA 与 100 多家行业伙伴推出 Open Agent Safety Platform,整合 OpenShell 与 Sentry,目标是构建安全智能体系统的信任层。黄仁勋称这不只是一款产品,而是一个开放生态的开端,安全与创新并不冲突,信任是 AI 经济的基础。
Simon Willison 就 AI 对软件工程师生活的影响给出收尾思考,并引用自行车冠军 Greg LeMond 的一句话。该内容发布于 @WeAreDevs 相关讨论,未给出具体模型或技术细节。
Simon Willison 提出 "Fable class models" 这一说法,用来指代一档模型:最早是 Claude Fable 5,如今包括 Claude Opus 5.5、GPT-Astra 6,GPT-5.6 Sol 或许也算。他未在推文中给出该档位的具体判定标准。
Simon Willison 为他在 San Jose 的 Devs World Congress North America 上所做主题演讲的视频,发布了详细笔记和带标注的文字实录。这份盘点回顾了 2026 年迄今 LLM 与 AI 智能体领域发生的各项进展。
Naval 发推表示"没有人能填补另一个人留下的空缺",该帖获得 15692 次点赞、1116 次转发和 829483 次浏览。
NVIDIA CEO 黄仁勋在 CNBC 表示,AI 智能体需要明确的能力边界,且这些限制必须在智能体运行过程中持续有效。他介绍了 NVIDIA 正在构建的相关安全措施。
开源模型的私有化部署正成为新趋势:隐私与合规风险凸显、开源模型能力已过可用阈值、企业 token 开销失控推动成本考量,但版本迭代投入、使用频率不足导致综合成本高于云厂商、私有化部署稳定性仍是问题。
Bright Mirror 使用 Claude Opus 5.5 制作了一段视频,调侃 AI 末日论者的恐慌情绪,称"什么都没发生"、并未出现预期的 FOOM 智能爆炸,并呼吁"加速"。该内容由 Julien Chaumond 转发。
OpenClaw 之父 Peter Steinberger 与 GitHub 联合创始人 Tom Preston-Werner 在播客《AI Worth Using》中提出,AI 批量生成样板代码后开源项目应废除传统 Pull Request,改收附带思考链路与脱敏 Prompt 的 Issue。
马斯克在央视财经约26分钟专访中表示,Anthropic 让 AI 擅长了软件工程,但还没人让 AI 真正擅长现实世界工程。他计划用 SpaceX 和 Tesla 的工程数据训练 Grok,让模型进入汽车、机器人和火箭系统;并称按每单位算力性能看中国可能明显领先。