OpenAI 722篇AI数学手稿引争议
先了解这件事
2026年10月6日至7日,OpenAI公开由未发布内部前沿模型产出的722篇数学手稿,按372个结果族归类,来自约4000个研究问题的评测,平均每结果约消耗3小时ChatGPT Pro推理算力,论文与部分Lean证明发布于GitHub仓库openai/math,模型未公开。早先报道称涉及约4000个问题,后续报道称动用内部模型测试约8000个开放问题、命中率约5%,另有报道称手稿数为719份。社区称成果覆盖数论、代数几何、组合数学等多个方向并涉及长期开放问题,部分报道称包含准黎曼猜想推进到7/8、复数域矩阵乘法指数降到2.25等说法,但需验证。争议随之升温:Gary Marcus批评报告缺乏流程、架构、失败率等可复现细节;人类数学协会发表声明批评大规模发布未经充分消化的成果,呼吁数学家停止与OpenAI合作,陶哲轩博客转发后被误传为其领衔。报道称仅162篇主要结果经计算机验证,另有报道称LLM已在7个千禧年难题中的4个取得实质进展但尚待验证。OpenAI已撤回3篇、修订14篇,README承认部分未形式化结果可能有问题;创业邦报道称编号074两篇手稿声称证明三维挂谷极大函数猜想与四维挂谷集Hausdorff维数猜想。Techcrunch最新报道称这些证明偏离了OpenAI咨询的数学研究者小组所制定的规范。
AI 根据报道生成 · 32 分钟前更新
事件进展
- 10月10日 11:18 · 1 篇报道Opus 5.5 将 722 篇 AI 数学论文生成 92 秒视频AI Will(@FinanceYF5):Opus 5.5 将 OpenAI 722 篇 AI 数学论文浓缩为 92 秒动态图形解说视频
- 10月9日 13:51 · 3 篇报道OpenAI发布数学成果,LLM攻克4个千禧年难题AI Will(@FinanceYF5):OpenAI 数学成果发布:LLM 已在 7 个千禧年大奖难题中的 4 个取得实质性进展
- 10月9日 02:10 · 1 篇报道OpenAI数学证明未达领域标准Techcrunch:OpenAI 的数学证明未达该领域标准
- 10月9日 01:18 · 1 篇报道Perplexity Computer 为 OpenAI 数学手稿生成讲解视频Aravind Srinivas(@AravSrinivas):Perplexity Computer 为 OpenAI 数学手稿的 722 篇预印本生成讲解视频
- 10月8日 23:16 · 5 篇报道陶哲轩转载声明抵制OpenAI数学成果发布The Rundown AI(@TheRundownAI):人类数学协会就 OpenAI 722 篇论文发布发声明,呼吁数学家停止与 OpenAI 合作
- 10月8日 17:41 · 3 篇报道OpenAI公布722份模型产出的数学成果Datawhale:OpenAI公布722份由前沿模型产出的数学手稿
- 10月8日 01:16 · 2 篇报道Gary Marcus与Terence Tao评论OpenAI数学成果garymarcus.substack.com:Gary Marcus 与 Terence Tao 评 OpenAI 新数学模型的模糊发布
- 10月8日 00:12 · 1 篇报道Gary Marcus 质疑 OpenAI 未发布模型的数学证明报告缺乏科学细节Gary Marcus(@GaryMarcus):Gary Marcus 质疑 OpenAI 未公开模型证明数学难题的报告
- 10月7日 12:59 · 5 篇报道OpenAI内部模型产出722篇数学手稿国际大厂:OpenAI 发布内部模型 722 篇数学论文,攻克 500 个公开数学难题中的 90 个
报道时间线
沿着报道,了解事件的不同侧面。
- 创业邦OpenAI 公开 722 篇数学手稿,声称证明三维挂谷极大函数与四维挂谷猜想
OpenAI 于 10 月 7 日一次性公开 722 篇数学手稿,论文和部分 Lean 证明上传 GitHub,作者栏均署 OpenAI。其中编号 074 的两篇分别声称证明三维挂谷极大函数猜想和四维挂谷集的 Hausdorff 维数猜想,后者把此前卡在 3 点几的维数下界直接推到 4,两篇共 272 页,四维论文还引用了三维论文中的引理。
- AI Will(@FinanceYF5)Opus 5.5 将 OpenAI 722 篇 AI 数学论文浓缩为 92 秒动态图形解说视频
作者仅提供一个提示词和论文页面 URL,就让 Opus 5.5 把 OpenAI 的 722 篇 AI 数学论文浓缩成一段 92 秒的动态图形解说视频。它展示的是单一提示词加链接输入下,模型对大规模论文集合做压缩并生成动态解说内容的效果。
- AI Will(@FinanceYF5)OpenAI 用未发布内部模型生成 722 篇数学手稿
OpenAI 发布了一款未公开内部模型生成的 722 篇数学手稿,按 372 个相关结果族归类,来自约 4000 道研究问题的评测。OpenAI 称标准流程每条结果平均消耗约三小时 ChatGPT Pro 的思考算力,此次发布包含论文、证明产物和部分推理摘要,模型本身仍未发布。
- 爱范儿陶哲轩转发抵制声明,数学界与OpenAI因722篇论文公开对立
OpenAI发布700多份数学手稿后,人类数学协会发声明呼吁数学家停止与其合作,菲尔兹奖得主陶哲轩在个人博客转载了该声明,后被误传为领衔发起。争议焦点在于722篇论文中仅162篇主要结果经过计算机验证,OpenAI次日撤下3篇手稿、修订14篇,并在GitHub仓库README中承认部分未形式化结果可能存在问题。
- AI Will(@FinanceYF5)LLM 已在 7 个千禧年大奖难题中的 4 个取得实质性进展
OpenAI 此次数学成果发布被 Opus 称为"史上影响最深远的一次数学成果发布",LLM 已在 7 个千禧年大奖难题中的 4 个上取得实质性进展。这一判断有一个重要前提:相关结果需要通过验证。
- AI Will(@FinanceYF5)OpenAI 数学模型攻克 7 个千禧年大奖难题中的 4 个
OpenAI 新模型在 7 个千禧年大奖难题中的 4 个上取得实质进展,涉及 Navier-Stokes(声称)、Riemann、Hodge 和 Birch-Swinnerton-Dyer,结果尚待验证。据 Deedy 称,每个结果平均仅消耗 3 小时思考算力,所用模型尚未发布。
- AI Will(@FinanceYF5)OpenAI 数学成果发布:LLM 已在 7 个千禧年大奖难题中的 4 个取得实质性进展
OpenAI 发布数学成果,被 Opus 称为"史上影响最深远的一次数学成果发布"。LLM 已在 7 个千禧年大奖难题中的 4 个上取得实质性进展,但该判断的前提是相关结果需要通过验证。
- Last Week in AILast Week in AI #346:OpenAI 发布 719 份数学手稿、两个西方开源模型、又一位安全研究员离职
OpenAI 于 10 月 6 日公开了由一款未发布内部前沿模型产出的 719 份数学手稿,覆盖 372 个主题族,并包含大量 Lean 形式化证明。Mistral 发布 1 万亿参数多模态模型 Mistral Large 4(绰号 Le Chonk),Reflection AI 推出 5010 亿总参数、230 亿激活的 MoE 开源模型 Beam。
- 硅星人Pro陶哲轩牵头人类数学协会发声明抵制OpenAI
菲尔兹奖得主陶哲轩牵头人类数学协会(AHM)发布联合声明,全面抵制OpenAI,敦促数学家停止与其合作。起因是OpenAI发布700多份机器生成的数学证明文件,动用内部模型测试约8000个开放数学问题,命中率约5%。声明指责其无视数学与人工智能咨询小组(AGMAI)的红线警告,缺乏同行评审与人类可读逻辑;图灵奖得主杨立昆则持相反态度,认为形式证明自动化将开启数学新时代。
- DeepTech深科技陶哲轩转载声明声援抵制 OpenAI,数学界与 AI 巨头矛盾升级
10 月 7 日,菲尔兹奖得主陶哲轩在个人博客全文转载“人类数学协会”(AHM)的声明,该声明批评 OpenAI 大规模发布未经数学界充分消化的研究成果,并呼吁数学家停止与 OpenAI 合作。
- THE DECODER数学家呼吁抵制 OpenAI,AI 生成证明大量涌入数学界
数学家组织 AHM 发表声明,批评 OpenAI 一次性发布 700 多个 AI 生成的数学证明文件,称其不是学术展示而是力量展示,部分数学家呼吁抵制 OpenAI 产品。陶哲轩在博客转发该声明并提出数学应进入不再以解题为核心指标的 Math 2.0 时代,Scott Aaronson 则对比了 OpenAI 批量放出证明与 Anthropic 与研究者合作、给予补偿并写出人类可读证明的两种模式。
- Aravind Srinivas(@AravSrinivas)Perplexity Computer 为 OpenAI 数学手稿的 722 篇预印本生成讲解视频
Perplexity Computer 为 OpenAI 数学手稿发布中的全部 722 篇预印本生成了讲解视频,总时长 93 小时,并整理成 YouTube 播放列表(722.video)。用户可在 722.video 观看这些视频,官方还说明了 Computer 完成该任务的方式。
- The Rundown AI(@TheRundownAI)人类数学协会就 OpenAI 722 篇论文发布发声明,呼吁数学家停止与 OpenAI 合作
人类数学协会针对 OpenAI 发布的 722 篇论文发表声明称“数学家并未要求做这项工作”,并呼吁数学家停止与 OpenAI 合作。菲尔兹奖得主 Terence Tao 以客座文章形式在其博客转发该声明,X 上随后将其当作 Tao 本人的表态传播。OpenAI 已撤回其中 3 篇论文,另有 14 篇在发布后经过修订,其发布说明中曾表示部分未形式化的结果可能存在问题并会尽快修复。
- DatawhaleOpenAI公布722份由前沿模型产出的数学手稿
OpenAI公布了一批由内部前沿模型产出的数学研究成果,包括722份数学手稿和372组相关成果,覆盖数论、代数几何、实分析、组合数学、理论计算机、数学物理、偏微分方程等多个方向。部分成果附有可由计算机核验的Lean形式化证明,社区初步核查发现其中涉及多个长期未解的开放问题,但具体结论仍需数学界进一步审阅与验证。OpenAI表示,AI正在从辅助解题走向参与真正的数学研究与发现。
- 国际大厂OpenAI 公开 722 份数学稿件;Chrome 155 支持 JPEG XL;Google 发布 EmbeddingGemma 2
OpenAI 公开内部前沿模型产出的 722 份数学稿件、归为 372 个结果族,部分附 Lean 形式化证明,仓库说明验证状态不一、未形式化结果可能有问题。Google 发布 Apache 2.0 许可的 EmbeddingGemma 2,总参数 7.4 亿、文本部分 2.7 亿,可映射文本、图像、音频和视频到同一向量空间。
- 数字生命卡兹克精选OpenAI开源722份数学手稿,引发数学界震动
OpenAI在GitHub发布openai/math仓库,公开722份数学手稿、归为372组成果,覆盖数论、代数几何、组合数学等方向,全部来自一个未公开的内部模型。作者称这些成果平均每个花费约3小时ChatGPT Pro级思考算力,其中包含将准黎曼猜想推进到7/8、复数域矩阵乘法指数降到2.25等说法,同时记录了25位菲尔兹奖得主联名信等数学界的质疑与争议。
- Gary Marcus(@GaryMarcus)Gary Marcus 与 Terence Tao 评 OpenAI 数学大动作
Gary Marcus 与 Terence Tao 就 OpenAI 在数学领域的一次重大发布发表了互补性评论,二人试图解读数学研究由此进入的新范式。相关评论发布于 Gary Marcus 的 Substack 通讯。
- garymarcus.substack.comGary Marcus 与 Terence Tao 评 OpenAI 新数学模型的模糊发布
Gary Marcus 与 Terence Tao 就 OpenAI 新公布的数学成果发表互补评论。Marcus 指出,OpenAI 仅称"用同一流程、借助未发布模型"完成证明,未披露架构、失败率、训练与数据增强细节,还提到证明是否由 Lean 一次性生成并验证也不清楚。他认为无法判断该结果的通用性,甚至无法排除其只是借助 Lean 与合成数据在可验证领域取巧。
- Gary Marcus(@GaryMarcus)Gary Marcus 质疑 OpenAI 未公开模型证明数学难题的报告
Gary Marcus 指出 OpenAI 一份用未发布模型完成数学证明的报告缺乏关键信息:未说明具体流程、架构、失败率及训练细节,因此无法判断结果在数学之外的可泛化性。他认为该报告无法通过同行评审,外界对该成果的喝彩也缺乏基本科学追问,该系统究竟迈向 AGI 还是仅靠 Lean 与合成数据在可验证领域取巧,从报告中几乎看不出。
- PyTorch研习社精选OpenAI 用内部模型产出 722 篇数学手稿并公开至 GitHub
OpenAI 于 2026 年 10 月 6 日发布消息称,用一个尚未公开的内部前沿模型一次性产出 722 篇数学手稿,整理为 372 个结果,来自对约 4000 个开放研究问题的评估,平均每个结果算力约相当于 ChatGPT Pro 思考 3 小时,成果全部放在 Apache-2.0 协议的 GitHub 仓库 openai/math 中。
- 国际大厂精选OpenAI 发布内部模型 722 篇数学论文,攻克 500 个公开数学难题中的 90 个
OpenAI 从一个未发布内部前沿模型公开了 722 篇数学手稿,归入 372 个结果族,来自约 4000 个研究问题的评测,平均每个结果约消耗 3 小时 ChatGPT Pro 推理算力,同时发布论文、证明工件与部分推理摘要,模型本身仍未公开。
本事件热度走势
当前热度 46·可比范围峰值 46(10月10日 18:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。