Claude的黎曼猜想突破
TECH

Claude的黎曼猜想突破

31+
Signals

战略概览

  • 01.
    Anthropic报告称,一个未发布的Claude研究版本将黎曼zeta函数非平凡零点位于临界线上的比例的已证明下界从41.6%提高到了67.2%。
  • 02.
    该结果并未证明黎曼猜想本身;它只是改进了关于零点子集的一个相关密度界限,并未定位其余不在临界线上的零点。
  • 03.
    Claude首先生成并尝试了650个想法但均未成功,随后在第二次会话中协调了约60个子代理,持续约1.5天,运行了2,400条shell命令并编写了数百个Python脚本才得出该结果。
  • 04.
    该证明已在Lean定理证明器中形式化,并由Anthropic内部数学家以及外部数论专家进行了审查。

深度分析

打破46年僵局的单一思想

人类数学家从1974年到2020年花了46年时间,才将已证明的下界提高了约8个百分点[3]。Claude在一次运行中就跨越了超过三倍于此的差距,将数值从41.6%提升至67.2%,实现了25.6个百分点的飞跃[1]。使其成功的突破性思路是概念性的而非计算性的:Claude没有将临界线上的零点和线外零点作为两个独立问题来分析,而是构建了一个基于Weil诱导的二次型的统一空间,其中正定子空间代表临界线上的零点,负定子空间代表线外零点[1]。Anthropic自己的报告将决定性步骤归功于一个具体的大胆举动:‘敢于将整个空间视为一体,同时考虑正定性和负定性,并允许二次型为非对角形式,在某种意义上正是这一步使Claude能够基于重要前期工作得出结论’[1]。换句话说,所需的基本要素(2000年Enrico Bombieri的论文以及后续的配对关联研究脉络)早已存在;所缺少的只是将其以非对角、统一形式组合起来的意愿。

650次失败尝试后的突破

通向这一结果的道路并非首次尝试就获得优雅洞见。Claude的第一次尝试生成并测试了650个不同的想法,但无一成功[1]。只有在被提示再次尝试后,它才组织了大约60个子代理,在约一天半的时间内协调执行了2,400条shell命令和数百个Python脚本[5],两次会话总共消耗了3,100万输出token[1]。启动整个链条的提示并非来自数学家,而是一位Anthropic员工随口提出的请求——让Claude‘认真尝试一下’这个猜想,之后所有数学选择均由模型自行决定[4]。这一起源故事——一个随意的请求后接开放式的鼓励而非技术指导——在结果传播后也成为热议话题:社交媒体上的评论对此类松散、非技术性的提示方式反应不一,既有对结果本身的真实震惊,也有对其过程听起来过于不科学的尖锐质疑。

67.2%究竟证明了什么,又没证明什么

这个标题数字容易引发误解。正如某媒体直接指出的:‘这并不是向证明黎曼猜想前进了67.25%。它也没有定位到那剩余32.75%不在临界线上的零点’[2]。Anthropic自身的说明更进一步,明确表示‘目前所用的技术几乎没有可能导向黎曼猜想的完整证明’[3]。Claude实际建立的是一个自然密度下界:即对位于临界线上零点比例的保证,而不是排除那些可能不在其上的零点的方法。这一区别至关重要,成为数学素养较高的受众接触该结果后讨论的主要技术焦点——反复强调的观点是,即使密度界限接近100%,也不等于证明,因为仍可能存在极小但非零的例外集合,超出任何密度论证的覆盖范围。这种张力——一方面是有史以来由AI辅助取得的空前进展,另一方面是类型明确且已被充分理解的结果——正是该事件真正的分歧所在。

形式化证明与非正式评审

该结果的可信度很大程度上依赖于Lean这一形式化证明助手,Claude的输出在Anthropic研究员Eric Easley的帮助下被翻译进了Lean系统[6]。但形式化验证回答的问题比‘这是否正确且重要’要窄:它确认的是逻辑一致性,而非数学上的自然性或现实世界中的适用性[3]。外部评审方面,则来自两位受邀的数论专家,他们在短时间内给出了积极但非正式的评价;截至发布时,该工作尚未提交期刊,也未完成同行评审[3]。这种机器验证的逻辑与人类评判的重要性之间的差距,构成了反应中怀疑派的主要立场:一些读者指出该报告具有伪造或夸大结果的特征,另一些人则反驳称Lean和Mathlib的形式化本身就是反对伪造的直接证据。这两种反应可以同时成立——逻辑经得起检验,而其重要性如何仍是一个开放的人类判断问题。

历史背景

人类研究者在46年内仅将下界提高了约8个百分点,而Claude单步跃升了25.6个百分点。
发表了一篇使用Weil二次型的论文,成为Claude在其方法中组合的关键构件之一。
确立了此前无条件记录的下界——临界线上5/12(即41.666%)的零点比例,该记录现已被Claude的结果超越。
发布了宣布Claude将黎曼zeta函数零点下界从41.6%提升至67.2%的研究简报。

关键关系图

关键玩家
主题

Claude的黎曼猜想突破

事实来源

6 条引用
  1. [1] Anthropic Research Note: Riemann Zeta
  2. [2] Kingy AI: Claude Riemann Hypothesis 67 Percent Result
  3. [3] Xenospectrum: Claude Riemann Zeta Critical Line Lower Bound
  4. [4] DataCamp: Claude and the Riemann Hypothesis
  5. [5] Metirai: Anthropic Claude Riemann Hypothesis Lower Bound
  6. [6] BigGo Finance: Claude Riemann Hypothesis

来源文章

Top 5

THE SIGNAL.

Analysts

明确指出所使用的技术不会导致黎曼猜想的完整证明,将该结果定位为副产品,而非对RH本身的推进。

Anthropic (research note)
结果发布方

指出验证仍属非正式:尚未提交期刊或完成同行评审,且外部评审是快速进行的,而非严格的审稿流程。

Unnamed analysis (xenospectrum.com)
科技/科学出版物

将该结果视为一次意外的附带发现,而非预定目标,强调没人预期Claude能直接解决RH。

DataCamp tutorial author
AI/科技教育出版方
The Crowd

We asked an unreleased research version of Claude to take a stab at the Riemann hypothesis. It didn’t solve it, but it did make strides on a related problem: it increased the lower bound for the fraction of zeros of the Riemann zeta function that satisfy the hypothesis from

@@AnthropicAI17494

8 days ago, while jogging, I asked Claude to solve the Riemann Hypothesis It didn’t. 1.5 days later, it proved >= 67% of the zeros are on the line (prev: 41.6%) Still not sure what that means, but some analytic number theorists seem excited https://t.co/vN10oM22HI

@@jarredsumner4907

Absolutely insane. This might be the clearest glimpse yet of how AI will transform scientific discovery. Anthropic asked an unreleased version of Claude to take a real stab at the Riemann Hypothesis, one of the most famous unsolved problems in mathematics. It failed. But while...

@@kimmonismus3175

Anthropic asked an unreleased version of Claude to solve the Riemann Hypothesis

@u/zqrt1500
Broadcast
MYSTERIOUS New Claude Model, Grok 4.6 TODAY, Muse Glimmer 30B, New OpenAI Model, & More! AI News

MYSTERIOUS New Claude Model, Grok 4.6 TODAY, Muse Glimmer 30B, New OpenAI Model, & More! AI News

AI makes progress on the Riemann Hypothesis! Huge improvement on lower bound of zeroes on the line!

AI makes progress on the Riemann Hypothesis! Huge improvement on lower bound of zeroes on the line!

【速報】Claude未公開モデル リーマン予想関連問題を一歩進める AIが数学史を大きく動かした瞬間!!

【速報】Claude未公開モデル リーマン予想関連問題を一歩進める AIが数学史を大きく動かした瞬間!!