OpenAI的Astra模型解决了10个开放数学问题
TECH

OpenAI的Astra模型解决了10个开放数学问题

42+
Signals

战略概览

  • 01.
    OpenAI下一代模型家族的一个内部未发布版本,代号为Astra,解决了数学和理论计算机科学领域的十个此前未解的问题,其中最引人注目的是首次显式构造了一个非可和群——这一问题自1999年以来一直悬而未决。
  • 02.
    OpenAI通过一份249页的手稿以及所有十个结果的机器可验证Lean 4证明证书支持了这些主张,这些内容已发布在GitHub上,估计计算成本约为2000美元。
  • 03.
    外界反应两极分化:独立数学家托马斯·布鲁姆(Thomas Bloom)称这些成果意义重大,但反对AI取代数学家的说法;而批评者如塔斯敏·楚(Tasmin Chu)则认为,这种表述抹去了证明所依赖的人类研究成果,并削弱了同行评审,呼应了数学界《莱顿宣言》的立场。
  • 04.
    这一公告发布之际,山姆·阿尔特曼(Sam Altman)正在华盛顿向美国参议员展示Astra模型,该模型预计将首批提交至新的联邦框架下,该框架允许政府在前沿模型发布前最多有30天的预览期。

深度分析

Astra真正证明了什么——以及它没有证明什么

最引人注目的成果是首次显式构造了一个非可和群,解决了自1999年米哈伊尔·格罗莫夫(Mikhail Gromov)提出可和性概念以来悬而未决的问题——人类数学家27年来屡次尝试均未成功[1]。除了这一标志性成果外,同一内部Astra模型还否证了冯·诺依曼代数上的Connes刚性猜想,证明了Ehrhart体积猜想,解决了三个埃尔德什(Erdos)问题(包括一个多色拉姆齐数问题),并自1978年以来首次改进了高维球体堆积密度的一般上界——打破了持续48年的天花板[1]。它还提出了双人量子博弈的平行重复定理,以及计算永久函数电路复杂度的新下界[2]。在“解决十个问题”的表述中被忽略的是,这十个成果并非同等分量——有些是对已有猜想的完整证明,有些是通过显式反例进行的否证(这类问题恰好契合大语言模型在构造与验证方面的优势),还有一些是对现有界限的渐进式改进,而非最终解决。

在线数学社区的真实反应

在X平台上,这些成果不仅仅是OpenAI的一纸新闻稿——公司自己的研究人员如塞巴斯蒂安·布贝克(Sebastien Bubeck)、诺姆·布朗(Noam Brown)和陈立杰(Lijie Chen)均在公开帖子中亲自确认了结果的技术细节,这为官方声明之外提供了第一方可信度,尽管尚非独立验证。公司外部的反应则更为复杂。在Reddit上,一位自称拉姆齐理论博士生的用户特别指出多色拉姆齐数的结果尤为突出,称其有望成为年度最佳组合数学论文之一——来自相关子领域的高度评价。其他Reddit上的数学家则对展示方式更为苛刻:多人指出Astra推理过程的行文难以理解,甚至类似‘民科’写作,批评其中使用了未定义的术语,使得论证本身难以独立理解,只能依赖其下的Lean证书。而2000美元的成本数字也未能经受住网络审查——多位Reddit评论者,而不仅仅是书面批评者,独立指出该数字几乎肯定只计算了成功的运行,排除了Astra尝试失败的问题所消耗的算力。再加上一层技术评论中流传的批评:‘解决’一词在公告中承担了过多语义负荷,因为这十个成果并非同等成就——有些是完整证明,有些是通过显式反例的否证,有些则是对现有界限的渐进式改进而非最终解决。

2000美元这个数字并不意味着人们以为的意思

公告中最病毒式传播的细节就是价格标签:OpenAI称这十个解决方案总共消耗了约2000美元的API算力[1][4]。这个数字已成为争议焦点,原因显而易见——它直接引发了与多年无偿、无名的人类劳动的对比。但这个数字也远不如表面看起来那么清晰。OpenAI并未披露Astra在最终取得这十个成果前尝试并失败了多少问题,仅表示在过程中尝试并失败了其他重大问题,据OpenAI研究员诺姆·布朗所述,他将这一结果视为科学推理能力的重大进展,但也承认存在失败[2]。一个仅计算成功运行、完全不计入失败路径所消耗算力的2000美元数字,与‘从零开始以2000美元解决十个问题’的说法有着本质区别。当你审视这些证明所依赖的基础时,这种表述问题更加尖锐:批评者指出,非可和群的构造严重依赖于数学家安德烈亚斯·托姆(Andreas Thom)和加博尔·昆(Gabor Kun)先前发表的工作,而这些基础性贡献在将成就归功于Astra的报道中面临被抹除的风险[4]。数学家塔斯敏·楚的反应捕捉到了这场反弹的情感核心:一个如此低的价格标签,却附着在她认为代表了约15年社区集体努力的工作上[4]

Lean验证不等于同行评审

OpenAI对质疑的回应是程序性的:除了249页的手稿外,它还发布了所有十个结果的机器可验证Lean 4证书,基于Lean 4.32.0和mathlib构建[1][3]。这相比OpenAI今年5月对单位距离猜想的否证是一次真正的可验证性升级,后者曾由外部数学家检查并认可[8]。然而,Lean证书仅能证明形式化陈述从形式化公理中推导而来——它并不能确立该形式化陈述就是数学家真正关心的定理,也不能证明其周围的论证对所声称推进的领域而言是可理解的[3]。这一差距在此处尤为关键,因为5月的结果曾得到包括菲尔兹奖得主蒂姆·高尔斯(Tim Gowers)在内的知名外部数学家验证,他表示会毫不犹豫地推荐其发表于《数学年刊》(Annals of Mathematics)[1]——而Astra在8月的成果尚未以同样公开的方式获得这种具名的独立背书。

为何Astra出现在华盛顿,而不仅仅是在数学期刊上

这一时机并非偶然。山姆·阿尔特曼本人正亲自在华盛顿向美国参议员和政府官员展示Astra模型,将这些数学成果作为展示模型推理能力的核心试金石[5][7]。这一游说行动与6月2日的一项行政命令相吻合,该命令指示联邦机构建立一个自愿流程,允许政府在前沿模型发布前最多有30天的访问期[6]。Astra预计将首批提交至该框架下,这使得数学成果不再仅仅是一次纯粹的研究公告,而更像是一场公开论辩的开端——OpenAI希望监管者相信其下一代旗舰模型有多么强大,以及为何可以安全地快速发布。

历史背景

在群论中引入了可和性的概念,提出了非可和群是否存在这一问题——该问题在Astra构造出实例前悬而未决长达27年。
此前关于高维球体堆积密度的一般上界可追溯至1978年;Astra在48年来首次改进了该界限。
一个更早的OpenAI内部推理模型否证了保罗·埃尔德什(Paul Erdos)1946年的单位距离猜想,该结果经外部数学家检查并认可,为AI生成数学成果及其后续争议树立了先例。
签署了一项行政命令,指示联邦机构建立一个自愿流程,允许政府在前沿AI模型发布前最多有30天的访问期,Astra预计将率先通过该框架。
发布了《莱顿宣言》,警告AI公司正在未经同意的情况下使用已发表的数学研究成果,绕过同行评审,并威胁证明与归属规范的完整性。
发布了Astra十项证明的公告、手稿和Lean证书,同时山姆·阿尔特曼在华盛顿向美国参议员预览了Astra模型。

关键关系图

关键玩家
主题

OpenAI的Astra模型解决了10个开放数学问题

事实来源

8 条引用
  1. [1] OpenAI's Astra Model Solves Ten Math Proofs, Including First Non-Sofic Group Construction
  2. [2] OpenAI Announces Its Next Major Model, Astra, By Dropping Ten Previously Unsolved Math Solutions
  3. [3] OpenAI's Astra: 10 Math Problems Solved With Lean Proofs
  4. [4] Mathematicians Need To Act
  5. [5] OpenAI Says It Has Solved 10 Open Math Problems Using Astra, Its New Model
  6. [6] OpenAI Senators: Astra And The 30-Day Review Framework
  7. [7] Altman Demos Astra To US Senators Amid Frontier Model Review Push
  8. [8] OpenAI Model Disproves Erdos Unit Distance Conjecture

来源文章

Top 5

THE SIGNAL.

Analysts

称这些成果在某些方面比OpenAI早前对单位距离猜想的否证更为重要,但反对暗示AI将取代数学家的表述,指出该系统建立在逾一个世纪积累的数学理论基础之上。

Thomas Bloom
英国皇家学会大学研究员,曼彻斯特大学 / erdosproblems.com

赞扬了这些成果的技术与美学质量,并强调通过Lean证书及随附的链式思维推理过程所实现的可验证性。

Sebastien Bubeck
OpenAI数学研究主管

将这一结果视为科学推理能力的重大进展,同时承认Astra在其他尝试的问题上失败,并暗示进一步的测试时算力可能扩展这些成果。

Noam Brown
OpenAI研究员

认为2000美元的成本数字轻视了约15年的社区集体努力,报道中对支撑证明的人类数学家的贡献存在被抹除的风险,并指出该职业可能因年轻研究者感到被贬低而流失人才。

Tasmin Chu
数学家 / Substack作者
The Crowd

yes, nonsofic groups exist: this statement is one of many new beautiful results proved by Astra, our next major model. We're releasing 10 such Astra proofs, complete with lean certificates and CoT walkthroughs for each of them. The results are wide-ranging, from von Neumann algebras (disproof of Connes' Rigidity Conjecture) to better bounds for high dimensional sphere packing, for circuit complexity, for monochromatic triangles in multicolored graphs, and more. More thoughts here: openai.com/index/ten-adva...

@@SebastienBubeck6236

An internal version of Astra, @OpenAI's next major model family, solved 10 major open problems in mathematics, quantum complexity, and theoretical computer science. We believe it will be a major step for scientific reasoning. openai.com/index/ten-adva

@@polynoamial15975

10 proofs from our next major model Astra on long-standing open problems in mathematics and theoretical computer science (also including new circuit lower bounds for computing the permanent!) GPT-5.6 has already enabled so much exciting work in math and science. Can't wait to see what comes next!

@@wjmzbmr11888

OpenAI: Ten advances in mathematics and theoretical computer science

@u/Salt_Attorney822
Broadcast
OpenAI's Astra JUST solved math...

OpenAI's Astra JUST solved math...

OpenAI's Hidden Model Astra Just Broke Mathematics

OpenAI's Hidden Model Astra Just Broke Mathematics

OpenAI Astra and the Truth Behind 10 Solved AI Mathematical Proofs

OpenAI Astra and the Truth Behind 10 Solved AI Mathematical Proofs