LLM 已在 7 个千禧年大奖难题中的 4 个取得实质性进展
OpenAI 此次数学成果发布被 Opus 称为"史上影响最深远的一次数学成果发布",LLM 已在 7 个千禧年大奖难题中的 4 个上取得实质性进展。这一判断有一个重要前提:相关结果需要通过验证。
OpenAI 此次数学成果发布被 Opus 称为"史上影响最深远的一次数学成果发布",LLM 已在 7 个千禧年大奖难题中的 4 个上取得实质性进展。这一判断有一个重要前提:相关结果需要通过验证。
OpenRouter 联合创始人 Alex Atallah 在 Stripe 收购后首期播客中,与 Replit 联合创始人 Amjad Masad 及 a16z 的 Erik Torenberg 探讨 AI 的未来为何是独立与专业化。
高通在圣迭戈总部搭建面向5G和6G的研发测试平台,用无线信号追踪无人机并由AI分类,展示其6G愿景的连接、感知、高性能计算三大基石。高通提出"计算连续体"多层架构,并计划推出面向家庭和小企业、可承载万亿级参数模型的设备形态;同时探索把AI算力下沉到基站侧,供运营商提供"算力即服务"或"Token即服务"。
普林斯顿博后张载熙创立AI4S公司科理新序(Scinetics),近日完成近5000万元人民币融资,英诺科创基金领投,沂景资本、小苗朗程、麟阁创投跟投。公司核心是开发多模态长程推理基座模型,提出Science Token概念,将小分子、核酸、蛋白质结构等科学数据转为统一表征单元,不经过人类语言转译,短期聚焦生命科学。
2026年上半年四家国产GPU合计收入52.42亿元,同比增长约162%,但7月以来沐曦、天数智芯股价最大回撤分别达55%和64%,且反弹乏力。作者认为原因是国产GPU稀缺性下降、研发投入占收入50.7%导致利润未跟上,且大客户议价权增强。推理时代ASIC抢增量、推理卡毛利率明显低于训练卡,连英伟达的估值倍数年内也压缩约17%。
NVIDIA 详解 Groq 3 LPX 的确定性执行如何在 NVIDIA Vera Rubin 平台上驱动高能效、高交互性推理。文章指出,功耗是 AI 工厂的核心约束,衡量 AI 平台价值的关键指标是每瓦性能而非未归一化的原始吞吐量。
SemiAnalysis 用自研 AgentX 智能体推理基准实测 NVIDIA Vera Rubin NVL72,在 Apples to Apples TRTLLM NVFP4 Dense 配置下。
Greg Brockman 宣布一个 AI 模型解决了千禧年大奖难题之一的 Navier-Stokes 方程,称这既是 AI 也是数学的重大里程碑,并指向科学发现的复兴。他希望该模型产出的知识能帮助学界更好理解非线性偏微分方程。
SemiAnalysis 发布 TPUv7 Ironwood 在 InferenceX 预览版上的首批第三方推理结果,在与 B200/B300 的同等条件对比中,Ironwood 每美元性能最高提升 50%。
DeepLearning.AI 汇总称,多家头部 AI 公司正把推理速度当作值得付出成本的架构要求。
DeepLearning.AI 指出头部 AI 公司正把推理速度视为值得投入的架构要求。OpenAI 与 Cerebras 展示 GPT 5.6 Sol 达到 750 tokens per second。
暗涌Waves独家获悉,国产GPU公司曦望Sunrise再获新一轮20亿元融资,投后估值约200亿元;今年4月其完成杭州资本领投的超10亿元融资、估值破百亿,不到半年接近翻倍。
Epoch AI 测算,以 Kimi K2.6 类模型在 Q4 2025 全部 Nvidia GB200 与 GB300 上的推理能力,可提供 5 亿至 200 亿 output tokens/秒,取决于请求上下文长度(8,000 / 25,000 / 128,000 输入 token)。
Modal 宣布完成 3.55 亿美元 C 轮融资,投后估值 46.5 亿美元,由 General Catalyst 和 Redpoint 领投。自去年 9 月以来公司规模增长五倍,年化营收超过 3 亿美元。