未曾实现的验证层
OpenAI跳过同行评审的核心论点是,Lean形式化——即可由机器验证的证明代码——使得手动验证比传统审稿“更可行”[1]。然而在实践中,这一替代方案既不完整,在至少一个案例中还具有误导性。截至2026年10月7日,719份幸存的主要成果中仅有约42%——即300份手稿——附带了经过机器验证的Lean证明,这意味着大多数主张依赖于OpenAI对其内部模型推理过程的单方面描述,而非独立确认[2]。更严重的是,一项配套分析交叉核对了其中一份经Lean形式化的头条成果——目录中的纳维-斯托克斯方程手稿——发现该证书实际上与书面论证不符:形式化中的一个估计需要四阶导数,而自然语言证明声称需要五阶;压力通量边界通过与散文描述不同的论证方式得证。换句话说,一个能顺利编译的Lean文件,并不能保证其所声称认证的英文证明就是实际被验证的证明——而此次发布的框架却模糊了这一区别。加里·马库斯的批评从另一个角度指出了同样的缺口:在未披露模型架构、失败率或生成流程的情况下,无法判断那已通过验证的42%是否能代表其余58%未验证的部分。“这永远无法通过同行评审,”他写道,强调方法的透明度而非产出数量,才是科学主张与技术演示之间的根本区别[3]。


