跳到正文

#推理

今日 0 条
10月9日周五
  1. AI Will(@FinanceYF5)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LLM 已在 7 个千禧年大奖难题中的 4 个取得实质性进展

    OpenAI 此次数学成果发布被 Opus 称为"史上影响最深远的一次数学成果发布",LLM 已在 7 个千禧年大奖难题中的 4 个上取得实质性进展。这一判断有一个重要前提:相关结果需要通过验证。

10月4日周日
  1. Amjad Masad(@amasad)AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenRouter 联合创始人 Alex Atallah 谈 Stripe 收购:为什么 AI 的未来是独立与专业化

    OpenRouter 联合创始人 Alex Atallah 在 Stripe 收购后首期播客中,与 Replit 联合创始人 Amjad Masad 及 a16z 的 Erik Torenberg 探讨 AI 的未来为何是独立与专业化。

9月19日周六
  1. 甲子光年AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    探访高通总部:6G网络如何从传输数据走向感知与计算?

    高通在圣迭戈总部搭建面向5G和6G的研发测试平台,用无线信号追踪无人机并由AI分类,展示其6G愿景的连接、感知、高性能计算三大基石。高通提出"计算连续体"多层架构,并计划推出面向家庭和小企业、可承载万亿级参数模型的设备形态;同时探索把AI算力下沉到基站侧,供运营商提供"算力即服务"或"Token即服务"。

9月17日周四
  1. 暗涌WavesAI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    科理新序张载熙:做AI4S多模态基座模型,以Science Token计费

    普林斯顿博后张载熙创立AI4S公司科理新序(Scinetics),近日完成近5000万元人民币融资,英诺科创基金领投,沂景资本、小苗朗程、麟阁创投跟投。公司核心是开发多模态长程推理基座模型,提出Science Token概念,将小分子、核酸、蛋白质结构等科学数据转为统一表征单元,不经过人类语言转译,短期聚焦生命科学。

9月16日周三
  1. 乌鸦智能说AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    投资人开始“抛弃”国产GPU了

    2026年上半年四家国产GPU合计收入52.42亿元,同比增长约162%,但7月以来沐曦、天数智芯股价最大回撤分别达55%和64%,且反弹乏力。作者认为原因是国产GPU稀缺性下降、研发投入占收入50.7%导致利润未跟上,且大客户议价权增强。推理时代ASIC抢增量、推理卡毛利率明显低于训练卡,连英伟达的估值倍数年内也压缩约17%。

  2. NVIDIA Technical BlogAI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA Groq 3 LPX 确定性执行如何为 NVIDIA Vera Rubin 带来高能效高交互推理

    NVIDIA 详解 Groq 3 LPX 的确定性执行如何在 NVIDIA Vera Rubin 平台上驱动高能效、高交互性推理。文章指出,功耗是 AI 工厂的核心约束,衡量 AI 平台价值的关键指标是每瓦性能而非未归一化的原始吞吐量。

9月15日周二
  1. SemiAnalysisAI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    SemiAnalysis 实测 Vera Rubin NVL72 智能体推理:每美元性能最高提升 67 倍

    SemiAnalysis 用自研 AgentX 智能体推理基准实测 NVIDIA Vera Rubin NVL72,在 Apples to Apples TRTLLM NVFP4 Dense 配置下。

9月9日周三
  1. Greg Brockman(@gdb)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Greg Brockman 宣布 AI 模型解决千禧年难题 Navier-Stokes 方程

    Greg Brockman 宣布一个 AI 模型解决了千禧年大奖难题之一的 Navier-Stokes 方程,称这既是 AI 也是数学的重大里程碑,并指向科学发现的复兴。他希望该模型产出的知识能帮助学界更好理解非线性偏微分方程。

9月8日周二
  1. SemiAnalysisAI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    SemiAnalysis 首次第三方实测 TPUv7 Ironwood 推理:每美元性能最高领先 B300 96%

    SemiAnalysis 发布 TPUv7 Ironwood 在 InferenceX 预览版上的首批第三方推理结果,在与 B200/B300 的同等条件对比中,Ironwood 每美元性能最高提升 50%。

9月2日周三
  1. DeepLearning.AI(@DeepLearningAI)AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI、Google、Nvidia 相继推出高速推理方案

    DeepLearning.AI 汇总称,多家头部 AI 公司正把推理速度当作值得付出成本的架构要求。

  2. DeepLearning.AI(@DeepLearningAI)AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepLearning.AI 盘点 AI 公司争夺推理速度:GPT 5.6 Sol 达 750 tokens/s

    DeepLearning.AI 指出头部 AI 公司正把推理速度视为值得投入的架构要求。OpenAI 与 Cerebras 展示 GPT 5.6 Sol 达到 750 tokens per second。

8月28日周五
  1. 暗涌WavesAI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    曦望再融20亿元,投后估值约200亿元

    暗涌Waves独家获悉,国产GPU公司曦望Sunrise再获新一轮20亿元融资,投后估值约200亿元;今年4月其完成杭州资本领投的超10亿元融资、估值破百亿,不到半年接近翻倍。

5月25日周一
  1. Epoch AIAI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Epoch AI:算力短缺要来了吗?

    Epoch AI 测算,以 Kimi K2.6 类模型在 Q4 2025 全部 Nvidia GB200 与 GB300 上的推理能力,可提供 5 亿至 200 亿 output tokens/秒,取决于请求上下文长度(8,000 / 25,000 / 128,000 输入 token)。

5月21日周四
  1. Modal BlogAI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Modal 完成 3.55 亿美元 C 轮融资,估值 46.5 亿美元

    Modal 宣布完成 3.55 亿美元 C 轮融资,投后估值 46.5 亿美元,由 General Catalyst 和 Redpoint 领投。自去年 9 月以来公司规模增长五倍,年化营收超过 3 亿美元。