OpenAI的722个AI生成数学证明引发数学家强烈反弹
TECH

OpenAI的722个AI生成数学证明引发数学家强烈反弹

31+
Signals

战略概览

  • 01.
    2026年10月6日,OpenAI发布由其未公开的前沿内部模型生成的722份数学手稿,整理为372个结果家族,并以Apache-2.0许可证发布至公共GitHub仓库;该模型共尝试解决约4000个开放性问题,每个结果平均消耗相当于ChatGPT Pro级别约三小时的计算资源。
  • 02.
    发布后一天,OpenAI撤回了三份与霍奇猜想相关的手稿,原因是发现一个符号错误,导致另外两篇被撤回论文所依赖的论证失效,总数从722降至719,并单独修订了14篇论文,更新了13条引用。
  • 03.
    此次发布声称在黎曼假设(部分‘准黎曼假设’结果)、与唯一游戏猜想相关的Lean形式化验证证明,以及CM阿贝尔簇的霍奇猜想解决方面取得进展。
  • 04.
    仅约42%的发布证明经过Lean形式化验证,719份手稿中仅有10份附带了链式思维摘要,且OpenAI未披露生成这些证明的模型身份,这两点均未达到其自身数学顾问小组的建议标准。

深度分析

标题数字背后的验证鸿沟

2026年10月6日,OpenAI发布由其未公开的前沿内部模型生成的722份数学手稿,整理为372个结果家族,并以Apache-2.0许可证发布至公共GitHub仓库[1]。该模型共尝试解决约4000个开放性问题,每个已发布结果平均消耗相当于ChatGPT Pro级别约三小时的计算资源[1]。其中引人注目的声明包括:部分‘准黎曼假设’结果、与唯一游戏猜想相关的Lean形式化验证证明,以及CM阿贝尔簇的霍奇猜想解决[2]。

但比722更重要的数字是42%——这是已发布证明中实际通过Lean形式化验证的比例,而该自动化证明检查标准正日益被视为数学界信任的基准[3]。在最终719份手稿中,仅有10份附带了展示模型推理过程的链式思维摘要[3]。这一差距并非理论问题:发布后一天,OpenAI因发现一个符号错误而撤回三份与霍奇猜想相关的手稿,该错误使另外两篇被撤回论文所依赖的论证失效,并单独修订14篇论文,更新13条引用[4]。这种‘先大规模发布,后发现错误’的模式,正是形式化验证本应防止的失败模式,而它本应在发布前而非发布后被捕捉。

OpenAI参与制定却未遵守的透明度标准

验证鸿沟之外,还存在第二个、或许更严重的鸿沟:信息披露。2026年9月,在其模型声称解决100多个长期数学与理论计算机科学问题引发争议后,OpenAI宣布成立由九人组成的数学与人工智能顾问组(AGMAI),由普林斯顿高等研究院主办,旨在为大规模发布重建信任[5]。一周后,AGMAI发布发布指南,建议前沿实验室披露每个声明结果所使用的具体模型、输入提示、简要推理链、耗时及计算成本[6]。

OpenAI在10月6日的发布并未达到这一标准。该公司未披露生成全部722份(后为719份)手稿的模型身份,仅通过公司控制的仓库发布,且仅提供部分推理摘要[7]。多伦多大学数学家丹尼尔·利特(Daniel Litt)认为,这种保密毫无正当理由:‘如果我们想知道这些数学问题的答案,我看不出有任何理由要求公司对我们保密’[7]。麻省理工学院的安德鲁·萨瑟兰(Andrew Sutherland)进一步指出,若无模型发布与独立复现,‘你应将任何关于单次提示解决难题的声明视为未经验证’[6]。OpenAI实际上参与制定了数学界如今正用以衡量它的规则,却在顾问组特别指出的两个维度——模型身份与推理透明度上,未能达到自身设定的标准。

通过新闻稿做数学:与机器赛跑的代价

此次发布的影响不仅限于对OpenAI严谨性的事后评判——它重塑了人类数学家实时工作的模式。当OpenAI的模型逼近与唯一游戏猜想相关的结果时,麻省理工学院的多尔·明泽(Dor Minzer)及其学生范雨谋(Yumou Fei)与王硕(Shuo Wang)加快进度,抢先发表自己的相关成果,以免被公司的发布计划超越[8]。明泽直言不讳地描述了这种不对称性:‘你是人类,对吧?你需要睡觉、吃饭,有情绪波动。你不知道自己会不会被这家万亿级公司抢发’[8]。

普林斯顿大学的马克·布拉弗曼(Mark Braverman)概括了这种竞争动态所代表的更广泛转变:‘通过新闻稿做数学对数学领域并不健康’[8]。担忧不仅关乎署名权——更在于,一个建立在同行评审、缓慢验证与共享发现基础上的学术激励结构,正被一家能一次性发布数百个声称结果、再由社区事后判断其有效性的公司所扭曲。对早期职业研究人员而言,他们数月努力研究的问题可能一夜之间变得无关紧要,无论AI生成的版本最终是否经得起审查。

陶哲轩的‘掠夺式开采’批评与抵制呼吁

最强烈的机构回应来自人类数学协会(AHM),其声明通过菲尔兹奖得主陶哲轩(Terence Tao)的博客发布,称此次发布‘并非学术的展示,而是权力的展示’,并呼吁数学家停止与OpenAI合作[9]。陶哲轩本人的批评超越了验证或署名权问题:他认为工业规模的AI解决开放性问题永久改变了学科的性质,因为‘一旦一个问题被视为已解决,它就无法再变回未解决’[10]。在此视角下,一次发布中批量生成数百个开放性问题的证明,不仅存在错误风险——更会永久‘掠夺式开采’这些问题的研究价值,扼杀通常伴随难题最终攻克而来的数年社区探索、试错与思想交融。

这正是抵制呼吁的真正利害所在:并非一次关于符号错误的争执,而是关于数学应否以‘解决问题’为优化目标,还是应追求更缓慢的进程——陶哲轩称之为‘数学2.0’——即阐释、教学与共同体理解,而单个公司的发布节奏无论多快都无法复制这一过程。

在线发酵的署名权争议

在正式顾问批评之下,一场更个人化的争议正推动着社交媒体上的反应。纽约大学数学家特里斯坦·巴克斯特(Tristan Buckmaster)称,OpenAI的发布‘毁掉了早期职业数学家的职业生涯’——这一说法在评论者中广泛共鸣,他们将此次发布更多视为对年轻数学家赖以生存的职业基础工作的贬值,而非研究贡献。

这一情绪与更早的未决争议交织:巴克斯特与Anthropic数学家莱文特·阿尔波格(Levent Alpoge)声称,OpenAI的模型复现了他们耗时约一年输入公司工具的关于纳维-斯托克斯方程的创新未发表方法,而OpenAI拒绝承认其署名权;OpenAI否认使用了他们的会话数据。更广泛的在线讨论也倾向于类似的怀疑立场——较少关注单个证明的正确性,而更关注一次性发布数百个未经审查结果的表象,以及缺乏期刊投稿所要求的背景评论。

历史背景

OpenAI宣布成立由九人组成的数学与人工智能顾问组(AGMAI),由普林斯顿高等研究院主办,旨在在早前声称其模型解决100多个长期问题后重建信任。
该顾问组发布发布指南,建议披露模型名称、提示、推理链摘要、耗时及计算成本。
OpenAI在GitHub上公开发布722份数学手稿,促使麻省理工学院的多尔·明泽及其学生加快发表自己的相关成果以避免被抢发。
OpenAI因符号错误撤回三份手稿,人类数学协会通过陶哲轩博客发布声明,呼吁抵制。
媒体报道指出此次发布未达到AGMAI标准——仅42%通过Lean验证,仅10份发布推理摘要——扩大了关于AI数学验证规范的争议。

关键关系图

关键玩家
主题

OpenAI的722个AI生成数学证明引发数学家强烈反弹

OP

OpenAI

发布了722份(后为719份)由未具名前沿内部模型生成的AI手稿,一天后因符号错误撤回三篇论文——其可信度与信息披露做法现成为争议核心。

AD

Advisory Group on Mathematics and Artificial Intelligence (AGMAI)

由普林斯顿高等研究院主办的九人独立专家组,制定了发布指南——包括模型身份、计算成本、推理摘要——而OpenAI在10月6日的发布未完全满足这些要求。

AS

Association for Human Mathematics (AHM)

数学家倡导团体,其声明通过陶哲轩博客发布,公开称此次发布为‘权力的展示而非学术’,并呼吁数学家停止与OpenAI合作。

TE

Terence Tao

菲尔兹奖得主,其‘数学2.0’批评——认为工业规模AI解题永久降低了学科的研究价值——成为此次反弹中最常被引用的论点。

DO

Dor Minzer (MIT)

为避免被OpenAI的发布超越,与学生范雨谋和王硕加快完成并发表其与唯一游戏猜想相关的成果,体现了此次发布对在职数学家造成的直接竞争压力。

AN

Andrew Sutherland (MIT) and Daniel Litt (University of Toronto)

公开质疑OpenAI未经验证的声明及隐瞒模型身份,主张在无复现与披露的情况下,结果应被视为未经验证。

事实来源

10 条引用
  1. [1] OpenAI Releases 722 Math Manuscripts From an Unreleased AI Model
  2. [2] OpenAI Releases AI-Generated Proofs Of Quasi Riemann Hypothesis, Unique Games Conjecture & Hodge Conjecture For CM Abelian Varieties
  3. [3] OpenAI's Math Solutions Aren't Meeting the Field's Standards, Yet
  4. [4] OpenAI Withdraws Preprints Among 722 Manuscripts on Unsolved Math Problems
  5. [5] OpenAI Launches Independent Mathematics Advisory Group Following Backlash Over AI Math Claims
  6. [6] OpenAI Says Secret AI Model Solved Advanced Math Problems
  7. [7] OpenAI's 722 Maths Papers Are Open. The Model Behind Them Is Not.
  8. [8] As AI Closed In on Unique Games Proof, Researchers Raced to Beat the Machines
  9. [9] AHM Statement on OpenAI's October 6 Release of Mathematical Documents
  10. [10] Some Mathematicians Call for OpenAI Boycott After AI-Generated Proofs Flood Their Field

来源文章

Top 5

THE SIGNAL.

Analysts

“认为工业规模AI解决开放性问题‘掠夺式开采’了学科,因为一旦问题被视为已解决,就无法再变回未解决,呼吁建立重视阐释与共同体理解的‘数学2.0’:‘一旦一个问题被视为已解决,它就无法再变回未解决。’”

Terence Tao
菲尔兹奖得主,加州大学洛杉矶分校

“表示在模型未公开且无法独立复现的情况下,不应信任未经验证的单次提示声明:‘在他们发布模型并允许他人复现结果之前,我认为任何关于单次提示解决难题的声明都应视为未经验证。’”

Andrew Sutherland
数学家,麻省理工学院

“认为OpenAI向需要评估其输出的数学家隐瞒模型身份毫无正当理由:‘如果我们想知道这些数学问题的答案,我看不出有任何理由要求公司对我们保密。’”

Daniel Litt
数学家,多伦多大学

“描述了与AI实验室发布节奏竞争的心理与竞争压力:‘你是人类,对吧?你需要睡觉、吃饭,有情绪波动。你不知道自己会不会被这家万亿级公司抢发。’”

Dor Minzer
数学家,麻省理工学院

“警告数学正日益由企业新闻稿而非同行评审过程驱动:‘通过新闻稿做数学对数学领域并不健康。’”

Mark Braverman
数学家,普林斯顿大学
The Crowd

“NYU math professor Tristan Buckmaster says OpenAI's Tuesday drop of 722 AI-generated math papers has "destroyed the careers of early career mathematicians."”

@@unusual_whales3260

“Mathematicians are still working through OpenAI's 160+ page Navier–Stokes proof a month later. I asked Claude Fable 5.5 to explain it. It made this 5-min 3D video: the proof in 8 steps. Caveats: Lean-checked, not yet fully human-verified. Needs an outside force.”

@@imjustnewatai517

“OPENAI DROPPED 722 MATH PAPERS WRITTEN BY ITS SECRET MODEL. Every manuscript came from an internal system that hasn't been released yet. They're grouped into 372 families across different fields. Among the boldest claims: - a zeta zero-free region, billed as the quasi-Riemann hypothesis...”

@@Mikadzyki_NFT94

“OpenAI unleashes hundreds more math results upon a field already in shock”

@u/ResultBackground24506000
Broadcast
OpenAI's biggest math breakthrough is getting ugly...

OpenAI's biggest math breakthrough is getting ugly...

BIGGEST Proof Dump in History! | OpenAI Release 722 Manuscripts

BIGGEST Proof Dump in History! | OpenAI Release 722 Manuscripts

OpenAI Just Broke Math With Its Most Powerful AI Yet

OpenAI Just Broke Math With Its Most Powerful AI Yet

OpenAI的722个AI生成数学证明引发数学家强烈反弹 — AI 新闻 | Agentic Brew