AI研究人员警告称,自动化AI研发可能引发智能爆炸
TECH

AI研究人员警告称,自动化AI研发可能引发智能爆炸

36+
Signals

战略概览

  • 01.
    一篇题为《如果自动化AI研发引发智能爆炸会怎样?》的工作论文于2026年9月28日由20多位合著者发表,其中包括图灵奖得主杰弗里·辛顿(Geoffrey Hinton)和约书亚·本吉奥(Yoshua Bengio)、OpenAI首席科学家雅库布·帕乔基(Jakub Pachocki)、Anthropic联合创始人杰克·克拉克(Jack Clark)、微软首席科学官埃里克·霍维茨(Eric Horvitz)以及Meta人工智能研究副总裁邓文(Dawn Song)[1]。
  • 02.
    该论文认为,AI系统自动化其自身的研发工作,可能将数年的AI进展压缩至数月甚至更短时间,而一旦这种动态开始,政策制定者采取行动的窗口期可能会迅速关闭。
  • 03.
    作为证据,作者引用了Anthropic的内部数据:在2026年3月至8月期间,由AI在轻度人类监督下完成的AI研发工作比例从1%上升至26%;而在2025年1月至2026年5月期间,AI在Anthropic公司已批准并合并的代码中所占比例从个位数低水平上升至超过80%[1]。
  • 04.
    论文明确指出,尽管OpenAI、Anthropic和微软的多位高级科学家参与了撰写,但这些公司并未正式支持其建议,并呼吁政策制定者监测AI自动化水平,并强制开发者提高透明度。

深度分析

警告背后的自动化数据

这篇论文与早期AI风险论述的不同之处在于,其核心主张得到了实验室自身已公布数据的支持,而非对遥远未来的预测。Anthropic披露,其内部AI研发工作中由AI在轻度或高层级人类监督下完成的比例从2026年3月的仅1%上升至同年8月的26%[1]。在更长的时间跨度内,由AI撰写的、经Anthropic批准并合并的代码比例从2025年1月的个位数低水平上升至2026年5月的80%以上[1]。与此同时,OpenAI的研究组织报告称,截至2026年8月中旬,每一个人类工作日对应3.1个代理工作日,系统常规性地完成了原本需要员工数天才能完成的研发任务[2]。论文的论点也依赖于规模:当前前沿研发仍涉及数千名人类研究人员,但AI系统可被复制并并行部署至数百万,从而消除历史上制约进展的人力瓶颈[1]。无论‘爆炸’是否真正发生,这些数据表明,底层的自动化趋势是真实、可测量且正在加速的,而非假设性的。

可信度悖论:建造者警告他们正在建造的东西

该论文在脚注中埋藏了一个不同寻常的声明:尽管来自OpenAI、微软和Anthropic的高级科学家参与了撰写,但文中内容并不意味着这些公司实际认可、支持或接受其建议[3]。这种作者身份与机构背书之间的差距已成为报道的核心争议点。英伟达(NVIDIA)首席执行官黄仁勋(Jensen Huang)公开称这些实验室的警告‘奇怪’,因为这些公司同时正在推动大规模算力建设,而这正是任何智能爆炸所需的基础设施[2]。网络上的反应也普遍持怀疑态度:围绕该论文及Anthropic领导层相关言论的讨论,倾向于将这一警告视为披着谨慎外衣的营销行为,批评者认为这些实验室实际上是在宣传他们竞相构建并销售的技术的危险性。这种怀疑并非毫无根据——一篇呼吁外部监管行业的论文,主要由该行业领导者撰写,但其雇主却不愿正式支持其诉求,这确实处于一种尴尬境地,读者有理由在评估警告内容的同时,权衡其背后的激励结构。

自我改进循环是否真的足够强大以失控运行?

与警报相对的是一个真实的技术反驳,而论文并未完全解决这一问题。研究机构Forethought的一项相关分析模拟了仅基于固定硬件效率提升的‘软件智能爆炸’情景,估计当前AI训练效率的翻倍周期约为8个月——这一速度是否足以引发爆炸,关键取决于‘软件研发回报率’这一变量,它决定了反馈循环是加速还是熄火[4]。另一项更广泛的学术综述审查了1,250篇关于AI系统参与自身改进的arXiv论文,提供了递归式自我改进研究实际进展的背景信息,与9月论文的框架有所不同[5]。社区的技术讨论进一步指出,当前的自我改进循环需要比现在强数倍才能维持自身运行,更不用说失控——此外,一些对近期‘递归自我改进’主张的技术剖析认为,它们根本不符合该术语的经典定义,当前的进展应被描述为在静态模型上的协调与搜索效率提升,而非真正的自我改进智能。这些观点并未排除论文所描述的情景,但意味着‘爆炸’这一表述在论文作者群体之外仍存在广泛争议。

论文实际上要求政府做什么

许多报道聚焦于戏剧化的表述,而非具体的诉求,但论文的核心建议相当明确:政策制定者应监测实验室内部的AI自动化水平,并强制开发者披露其研发流程中已有多少由AI驱动[1]。其理由是,一旦自动化跨越某些阈值,干预窗口可能迅速关闭,因此可见性必须在加速发生之前建立,而非之后[1]。论文还将担忧分为三类风险——AI能力增长速度快于社会适应能力、人类对日益自主的系统失去监督、现有对集中权力的制衡机制在面对能远超对手思考能力的行动者时失效——部分报道将最后一种情景的极端版本描述为可能导致人类被边缘化[6]。论文明确指出的具体极端风险包括AI赋能的疫情、对关键基础设施的攻击以及需要应急响应准备的大规模劳动力动荡[1]。从这个角度看,该论文更像是一次建立早期预警系统——透明度与监测机制——的呼吁,而非末日预言,其目标是在尚不确定底层趋势实际发展速度之前,提前构建应对框架。

历史背景

Anthropic公司经批准并合并的代码中,由AI完成的比例处于个位数低水平,这是论文后来引用以展示研发自动化加速速度的起点。
仅有1%的内部AI研发工作由AI在轻度或高层级人类监督下完成。
Anthropic公司经批准并合并的代码中,由AI完成的比例已超过80%;与此同时,克拉克向Axios表示,他预计自动化趋势将进一步加速,而非放缓。
另一篇综述论文《AI中的递归式自我改进:从有限自我优化到自主研究循环》审查了2024至2026年间1,250篇关于AI系统参与自身改进的arXiv论文,为9月论文提供了学术背景。
据报道,OpenAI的研究组织每人类工作日运行3.1个代理工作日;Anthropic在轻度监督下由AI完成的研发工作比例达到26%;Forethought的一份报告模拟了‘软件智能爆炸’情景,训练效率翻倍周期约为8个月。
由20多位作者撰写的论文《如果自动化AI研发引发智能爆炸会怎样?》发表,将前述数据点整合为正式的政策警告。

关键关系图

关键玩家
主题

AI研究人员警告称,自动化AI研发可能引发智能爆炸

JA

Jakub Pachocki

OpenAI首席科学家及论文合著者

JA

Jack Clark

Anthropic联合创始人及合著者,主张自动化趋势可能进一步加速

GE

Geoffrey Hinton and Yoshua Bengio

图灵奖得主合著者,为论文提供了外部学术可信度

OP

OpenAI, Anthropic, Meta, Microsoft

多位合著者的雇主,也是论文引用的内部自动化数据来源,但未正式支持论文的政策建议

CA

Cambridge Programme on AI Science & Policy / GovAI

论文的出版方与机构主办方

JE

Jensen Huang

英伟达首席执行官,公开质疑实验室警告的一致性,鉴于这些实验室在算力建设中的角色

事实来源

6 条引用
  1. [1] What if automating AI R&D triggers an intelligence explosion?
  2. [2] AI Scientists Call for Embedded Auditors to Watch the Intelligence Explosion
  3. [3] Anthropic, OpenAI Executives Urge Oversight of Self-Improving AI
  4. [4] Will AI R&D Automation Cause a Software Intelligence Explosion?
  5. [5] Recursive Self-Improvement in AI: From Bounded Self-Refinement to Autonomous Research Loops
  6. [6] Top AI Researchers Warn of Intelligence Explosion, Urge Policy Oversight

来源文章

Top 5

THE SIGNAL.

Analysts

“认为仅靠人类监督已不足以监控AI研发代理的行为,意味着AI系统本身需要监控其他AI代理。”

Dawn Song
Meta人工智能研究副总裁,合著者

“相信AI研发自动化加速的技术趋势更可能进一步加速,而非趋于平稳。”

Jack Clark
Anthropic联合创始人,合著者

“将AI实验室关于智能爆炸的警告描述为不一致,因为这些公司同时正在推动当前的算力建设。”

Jensen Huang
英伟达首席执行官

“对论文提出的嵌入式审计员模型提出实际性质疑,指出此类审计员所需访问标准仍不明确。”

Conrad Stosz
对论文政策建议的评论者
The Crowd

“SITUATION DETECTED: Researchers - including leaders at OpenAI, Anthropic, Meta, and Microsoft - published a paper arguing that automating AI research could set off an intelligence explosion, and that policymakers should urgently demand more visibility into progress on RSI.”

@@MTSlive452

“SITUATION EXPLAINED: OpenAI, Anthropic, Microsoft, and Meta just co-signed a paper on the intelligence explosion. • 22 authors from the Cambridge Programme on AI Science & Policy, including Eric Horvitz, Dawn Song, Hinton, Bengio, and Andrew Barto of Sutton and Barto • AI”

@@MTSlive42

“The authors say the automating of AI R&D is the most likely source of an intelligence explosion, because AIs are already contributing to improving their own technology and the resulting improved systems can be rapidly deployed once built.” AI godfathers warn of runaway ‘intelligence explosion”

@@gleonhard0

“AI godfathers warn of runaway 'intelligence explosion'”

@u/Wagamaga0
Broadcast
Did Google just kickstart the intelligence explosion?

Did Google just kickstart the intelligence explosion?

Top AI Researchers Just Issued an “Intelligence Explosion” Warning…

Top AI Researchers Just Issued an “Intelligence Explosion” Warning…

How we survive the intelligence explosion | Will MacAskill

How we survive the intelligence explosion | Will MacAskill