黄仁勋最新对话:AI 是十年范式转移,半导体规模需扩大 5 到 10 倍
黄仁勋在专访中称 AI 是一场长达十年的范式转移,未来十年半导体产业规模需扩大到目前的 5 到 10 倍,并强调开源模型是科学进步与网络安全的基石。他表示英伟达中国销售额约为零,已告知投资者不要期待任何来自中国市场的收入,同时认为 DeepSeek、Kimi 引发的市场震荡是对开源模型影响力的误读。
黄仁勋在专访中称 AI 是一场长达十年的范式转移,未来十年半导体产业规模需扩大到目前的 5 到 10 倍,并强调开源模型是科学进步与网络安全的基石。他表示英伟达中国销售额约为零,已告知投资者不要期待任何来自中国市场的收入,同时认为 DeepSeek、Kimi 引发的市场震荡是对开源模型影响力的误读。
Augment Code 宣布将 Kimi K3 引入其产品线,并称这是其测试过的最强开源模型。该模型即日起可在 Augment 的智能体编排平台 Cosmos 中使用,推理服务由 Fireworks AI 提供美国本地托管。
播客对谈百度智能云 AI 计算首席科学家王雁鹏,讨论从模型时代到 Agent 时代的底层技术演变。他认为这一代 AI Infra 与上一代不同,是以 GPU 为核心构建,需要以 CPU 消耗窥见 Agent 诞生的真实价值,并梳理 Anthropic、OpenAI、Google 的路线差异以及国内多芯适配与开源生态的两大差异。
vLLM社区维护者游凯超以Inferact联合创始人兼首席科学家身份受访,讲述这个伯克利校园开源项目用近3年从一篇算法论文变成开源社区、再变成公司。Inferact今年初完成1.5亿美元种子轮融资。访谈还讨论了开源项目商业化后的抉择,以及AI Infra与模型结构、Harness Engineering的联合设计。
Andrew Ng 称赞黄仁勋发布的 Nvidia 公开信,认为其值得一读。他援引 OpenAI-Hugging Face 黑客事件指出,防御需要开放模型与工具,闭源模型更安全的说法只是监管俘获。
月之暗面在 Kimi K3 开放日发布 Kimi K3 模型权重、技术报告,并开源支撑其训练的关键 Infra 技术 MoonEP、FlashKDA 和 AgentEnv。
Kimi K3 开放权重、技术报告与 Infra 技术,读者可了解其 2.8 万亿参数 MoE 与 3 倍规模化效率的具体做法。
月之暗面在 Kimi K3 开放日发布 Kimi K3 模型权重与技术报告,并开源支撑其训练的关键 Infra 技术 MoonEP、FlashKDA 和 AgentEnv。
月之暗面公开最强模型的权重与技术报告,并同时开源三项训练 Infra 技术,读者可据此了解其规模效率的实现路径。
NVIDIA CEO 黄仁勋发布首条推文,分享 NVIDIA 签署的一封关于开源模型重要性的公开信,称 AI 将变革每个行业、赋能每家公司,并由每个国家构建。信中表示开源模型能增强安全与网络安全、加速创新与扩散、实现主权,世界既需要前沿闭源模型也需要前沿开源模型。
Hugging Face 宣布加入 Open Secure AI Alliance,与 NVIDIA 等行业领先者共同帮助各组织识别和修复软件漏洞、加固关键系统。该联盟聚焦于通过共享研究、工具和真实世界经验来提升 AI 安全水平。
Dify 宣布 GitHub stars 突破 150,000,并称在 AI 以人类难以匹敌的速度写代码的当下,pull request 不断涌现,但 AI 不会在代码上署名,署名的是人。Dify 表示每一次 merge 都要经过另一双手的阅读、质疑与背书,一个名字因此变成两个,开源正是这样向前推进的。
Google Gemma 本周下载量突破 9 亿次,官方称即将达到 10 亿。博主 Patrick Loeber 同期发布博客,介绍如何将 Gemma 4 作为本地编程智能体运行。
Naval 表示,如果开源权重模型里藏有后门或偏见,可以指望闭源实验室把它们找出来并公之于众。该帖获 7940 次点赞、370 次转发,浏览量约 51.1 万。
MiniMax 发布开放权重模型,并提出"开放权重、开放研究、开放创新",宣称将迈向开放未来。该消息由 Hugging Face 转发,原帖互动量达 453 点赞、20 次转发。
Andrew Ng 就 @Mononofu 与 @JensenHuang 的讨论指出这是错误类比:每个人都有权让自己的代码保持闭源,问题在于有人试图阻止他人开源。
Gemma 4 模型下载量已超过 3 亿次,整个 Gemma 开源模型系列的累计下载量则突破 9 亿次。这一数据由 Demis Hassabis 发文澄清,并引用了 Olivier Lacombe 关于 Gemma 模型家族跨过 9 亿次下载里程碑的推文。
Gemma 模型家族累计下载量突破 9 亿次,Sundar Pichai 转发该里程碑消息并配文"1B next!",指向下一个 10 亿次目标。该数据由 Olivier Lacombe 披露。
Demis Hassabis 表示强大且安全的开放生态对全球受益于 AI 很重要,Google 已从 Jax、Transformers、AlphaFold 到 Gemma 开放模型持续贡献开源与科学,Gemma 系列下载量已超 3 亿次。他同时提到其提出的标准框架支持开放与专有模型的责任部署,并转发黄仁勋签署的公开信称世界需要前沿闭源与前沿开源模型并存。
Sundar Pichai 代表 Google 表态支持英伟达签署的开放模型公开信,并称 Google 长期受益于开源、也是开源的重要贡献者,通过 Google DeepMind 持续开放 Gemma 权重模型。该公开信由黄仁勋首次发帖分享,主张开放模型能强化安全与网络安全、加速创新与扩散并支撑主权需求,世界需要前沿闭源与前沿开源模型并存。
黄仁勋在 X 发布首帖,分享 NVIDIA 签署的一封公开信,主张开放模型能增强安全与网络安全、加速创新与扩散并实现主权能力。信中称 AI 将变革每个行业、赋能每家公司、由每个国家构建,世界既需要前沿闭源模型,也需要前沿开放模型。Jim Fan 转发并评价其为绝对传奇。
Jensen Huang 首次发帖,分享 NVIDIA 联署的一封公开信,主张开放权重模型的重要性。信中称 AI 将改变每个行业、赋能每家公司,并由每个国家构建;开放模型能增强安全与网络安全、加速创新与扩散、实现主权。NVIDIA 认为世界既需要前沿闭源模型,也需要前沿开源模型。
Lex Fridman 发文欢迎黄仁勋(@JensenHuang)加入 X,称其首条帖子很棒,并感谢他支持开源。
LiteParse v2.8.0 的图像转 PDF 功能不再依赖 ImageMagick,改用 Rust 原生实现,转换速度提升 1.2× 至 7.2×,具体取决于图像格式。此举让 LiteParse 距离完全自包含、零外部系统依赖更近一步。使用 LiteParse 的用户可升级并前往 GitHub 查看项目。
黄仁勋在 X 发布首条帖子,分享 NVIDIA 签署的公开信,主张开放模型能强化安全与网络安全、加速创新与扩散并实现主权能力。信中称 AI 将改变每个行业、赋能每家公司并由每个国家构建,世界既需要前沿闭源模型也需要前沿开源模型。
微软与业界多方共同提出一条路径,让开放权重模型服务于美国竞争力与经济机会,同时保护国家安全。Satya Nadella 称开放权重模型对健康的 AI 生态至关重要。
论文 GeoRK2 提出一种免训练、可插拔的扩散 Transformer 加速框架,把二阶 Runge-Kutta 积分与深度特征空间的几何结构结合,使大步采样仍保持稳定生成质量,已被 CVPR 2026 收录为 Highlight。
强少来了推荐开源书《深入理解 AI Agent》,该书围绕 Agent = LLM + 上下文 + 工具的核心公式,用 10 章把 AI Agent 从原理讲到工程实战,正文、配图与 92 个配套实验全部开源。
微软研究院宣布 MagenticLite 的模型已全面开源,MagenticBrain 和 Fara 1.5 以开放权重上线 Hugging Face,此前这两个模型只在 Microsoft Foundry 提供。该应用、harness 以及整个技术栈中的所有模型现在均已开放。
Kimi K3 上周发布,Qwen 宣布下一代大模型将采用开放权重,中国厂商在开源模型上的加速成为焦点。播客讨论了 GLM 5.2 的作用、美国开源生态、前沿与近前沿模型差距,以及蒸馏话题引发的 Ben Thompson 争论。
蚂蚁集团孵化的蚂蚁灵波刚发布第二代具身基础模型,首席科学家沈宇军在本期访谈中介绍了这次发布的 Depth、Vision、VLA、Video、World、VA 2.0 六个模型及其关系。
Marcel Rød 发布号称全球最快的 tokenizer 实现 Gigatoken,在多数机器和多数 tokenizer 定义下比 HuggingFace 快约 500-1000 倍,比 OpenAI 的 tiktoken 快约 100 倍,且对比的都是已多线程化的 Rust 实现。
Anthropic 在与美国政府沟通后重新上线 Claude Mythos 和 Fable 模型,并发布 Claude Sonnet 5,主打更低价格运行智能体、提升 agentic coding 与基准表现。Google 推出 NotebookLM 竖屏短视频摘要与更快的图像生成器 Nano Banana 2 Lite,中国开源 LongCat-2.0 MoE 模型同期发布。
美国政府首次对前沿模型发布实行审批式管控:Anthropic 获准向特定企业机构发布 Mythos-5,OpenAI 推出 GPT-5.6 "Sol" 且初期仅限约 20 家获批组织使用。OpenAI 同时公布首款自研推理 ASIC "Jalapeño"(与 Broadcom 合作、台积电 3nm 制程),GLM 5.2 以 MIT 许可发布并在长上下文编程任务上表现强劲。
Anthropic 在美国政府指令下切断了 Fable 5 和 Mythos 5 的访问,理由是涉嫌越狱。SpaceX 以约 1.75 万亿美元估值完成 IPO,随后以 600 亿美元收购 AI 编程公司 Cursor。
庄明浩在《沈帅波和他的朋友们》第五季返场对谈中判断,2026 年 AI 进入"挡不住"的狂飙期,多 Agent 集群把单个任务的运行时间拉长到十几个小时,Token 消耗随之几何级数暴涨。
Cognition 为 Devin 推出 Devin Outposts,让执行环节运行在用户自控和配置的环境中,推理仍留在 Cognition 云端。Modal 以开源集成 modal-devin 成为首发伙伴,Devin Outpost 会话可在 Modal Sandbox 中运行,获得快速冷启动、自定义镜像和快照能力,2026 年 7 月 21 日起进入 alpha。
Moonshot AI 于 7 月 16 日发布旗舰模型 Kimi K3,这是一个 2.8T 参数的 MoE 模型,权重将于 7 月 27 日发布。在 Vals AI 指数上排名第 2,在 Artificial Analysis 智能指数上排名第 3,仅次于 Claude Fable 和 GPT-5.6 Sol Max,同时价格更低,并在前端代码竞技场排名第 1。
从 K3 发布切入,梳理开放权重与闭源前沿差距收窄后的经济与政策连锁影响。
英国 AI 安全研究院(AISI)分析显示,开放权重模型与闭源前沿模型的网络安全能力差距正在收窄:GLM-5.2 与 DeepSeek V4-Pro 大致相当于此前 4 到 7 个月发布的闭源模型,窄于 2025 年多数时间测得的 6 到 10 个月。
Citrini Research 认为,近期 AI 板块抛售难以用开源替代、成本竞争或 Kimi K3 开源模型来解释——K3 体量庞大且已受算力约束。更可能的原因是杠杆推动的拥挤交易自我反噬,回调幅度往往与上涨的猛烈程度相称。该机构转而在市场共识之外寻找 AI 上行机会,包括一家把约束变成优势的移动芯片设计商,以及 IBM 财报不及预期中的最大受益者。
Yann LeCun 回应开源等同"倾销"的说法,列举 Linux、Apache、MySQL、PHP、HTTP、TCP/IP、OpenSSL、OpenSSH、Libjpeg、VLC、Signal、PyTorch、Llama 等开源项目作为反例。该帖获 3677 点赞、248 次转发。
Richard Socher 指出,在版权与 AI 能力上,欧盟、美国、中国之间正出现日益扩大的分歧。中国开源模型构建者可使用各类想法、受版权保护的文本以及漫画和动漫角色等,内容与想法的无限制流动成为优势,或将造就更强的模型。这让西方陷入两难:坚持合理且有价值的版权与知识产权法律,可能被中国超越并最终完全依赖外部 AI 模型。