特朗普政府针对前沿模型的自愿性人工智能安全审查框架
TECH

特朗普政府针对前沿模型的自愿性人工智能安全审查框架

37+
Signals

战略概览

  • 01.
    2026年6月2日的一项行政命令创建了一个自愿性框架,允许开发者在向其他可信合作伙伴发布‘受覆盖的前沿模型’之前,向联邦政府提供最长30天的访问权限。
  • 02.
    白宫在8月1日的截止日期前完成了该框架,并于8月4日召开会议,向OpenAI、Anthropic、Google、Meta、Nvidia和Microsoft通报了相关内容,但拒绝公开其内容。
  • 03.
    开源权重人工智能模型明确被排除在审查之外;只有被美国国家安全局(NSA)归类为构成国家安全风险的闭源模型才被纳入覆盖范围。
  • 04.
    该命令禁止任何强制许可或预先审批要求,使参与完全基于自愿——这是有意区别于上一届政府强制性发布前测试方法的做法。

深度分析

30天审查机制建立在只有NSA内部人员可见的数字之上

该框架的运作机制在纸面上看似简单:开发者可自愿在向其他可信合作伙伴发布前,向联邦政府提供最长30天的‘受覆盖前沿模型’访问权限[1]。但何为‘受覆盖’则变得模糊不清。该命令将其定义为闭源、最先进的、且构成国家安全风险的模型,但具体的门槛——基准测试、能力阈值——是由国家安全局局长在与CISA、国家网络总监以及总统科技助理协商后建立的机密系统所设定的[6]。开发者无法得知决定其模型是否被纳入审查的具体标准。

这种保密性不仅限于技术门槛,还延伸至框架本身。尽管一名白宫官员承认该文件并未正式分类,但政府仍选择不公开,辩称选择性披露是刻意为之:‘仅仅因为某些信息未分类,并不意味着我们会向所有人广播’[2]。批评者认为这种区分毫无意义。外交关系委员会的克里斯·麦奎尔(Chris McGuire)直截了当地指出:‘我们不能用秘密的、自愿的规则来监管世界上最重要的技术’[4]。对该框架的报道也提出了同样的疑问——一个政府之外无人能读的框架,建立在NSA之外无人能见的基准之上,是否还能兑现行政命令所承诺的透明度[2]。该命令还要求财政部、NSA和CISA建立一个‘人工智能网络安全信息交换中心’,以协调与产业界在漏洞扫描和补丁分发方面的合作[1]

开源权重豁免:对华战略、技术漠视,还是安全漏洞?

开源权重模型完全被排除在该框架之外——命令明确将受覆盖模型限定为闭源模型,并明确指出本命令不限制模型发布后的开源模型[7]。国家网络总监肖恩·凯恩克罗斯(Sean Cairncross)将此豁免视为战略举措:政府‘非常有兴趣探索建设美国开源人工智能的方法’,以与中国开源权重替代品竞争,因此免于审查的待遇实际上是一种激励,鼓励持续发布开源模型[3]

但一旦超越官方表述,这一理由便出现分歧。围绕该豁免的讨论中出现了一种技术性论点——即对开源权重模型进行安全测试本身价值有限,因为防护机制(guardrail classifiers)独立于核心模型权重,任何获得发布文件的人都可通过微调将其移除,使得发布前的网络安全审查对该类模型几乎只是象征性的。另一些人则持相反结论:一旦权重公开,开发者便失去了召回或监控模型使用方式的能力,这恰恰是一些批评者认为开源权重发布更危险、不应被豁免审查而非更安全的原因[9]。该框架并未解决这一矛盾——它只是简单地将界限划在闭源模型上,然后继续推进。

‘自愿’一词在此承担了大量功能

行政命令明确指出,其中任何内容均未授权对开发、发布、分发人工智能模型(包括前沿模型)实施强制许可、预先审批或许可要求[1]。对该命令的法律分析强调,这是一项真正的结构性限制,而不仅仅是修辞:‘对人工智能开发者没有新增强制义务。前沿模型框架明确为自愿性质,且禁止预先审批’[5]。这是有意逆转上一届政府倾向于强制发布前安全测试的做法[6]

然而批评者认为,‘自愿’标签更多是战略性的,而非实质性限制。安全人工智能联盟(The Alliance for Secure AI)的布伦丹·斯坦豪泽(Brendan Steinhauser)认为,该框架‘旨在阻止各州立法监管人工智能,且未为人工智能开发者对其产品造成的危害提供问责路径’[7]——换言之,一个无法强制任何行为的联邦项目,仍可作为更严格州级规则的上限,却未提供相应的联邦问责底线作为交换。信息技术与创新基金会(ITIF)提出了相关但不同的担忧:在缺乏公开规则的情况下,小型开发者、开源项目、独立安全研究人员及盟国政府只能猜测影响市场的标准,这一负担对那些无法参与闭门简报的参与者尤为沉重[8]。围绕该公告的社会评论也强烈聚焦于这一矛盾,将‘自愿’与机密规则手册并列,视为一种功能上的不一致,即使是对前沿模型国家安全审查总体持同情态度的人也难以接受。

谁在房间里,谁不在

该框架迄今为止的实际管理仅通过一个规模小且稳定的群体进行:白宫于8月4日召集OpenAI、Anthropic、Google、Meta、Nvidia和Microsoft六家公司,审查已完成的框架,其中OpenAI、Google和Anthropic此前已看到早期草案[4]。这六家公司中的四家——OpenAI、Anthropic、Google DeepMind和Meta——也被认为是最有可能率先构建符合机密‘受覆盖前沿模型’门槛的公司[6],这意味着同一群体既是该框架的主要对象,又是其主要咨询对象。

这种集中性正是透明度批评的另一面:问题不仅在于公众看不到规则,更在于特定的既得利益者可以看到。对8月4日会议的报道和网络讨论反复强调这一细节——目前参与该流程的渠道仅限于最大的实验室,这印证了ITIF的警告:小型开发者和独立研究人员没有可比渠道来理解或质疑该门槛如何适用于他们[8]。值得注意的是,随着该框架从草案进入实施阶段,这种不对称性是否会缩小,仍是政府尚未承诺披露的又一细节。

历史背景

特朗普总统签署了行政命令《促进先进人工智能创新与安全》,创建了前沿模型自愿审查框架,并设定了2026年8月1日的完成期限。
该命令将联邦人工智能监管范围缩小至网络安全和国家安全风险,明确取消上一届政府强制性的发布前安全测试,转而采用自愿参与方式。
该自愿性框架按照行政命令设定的期限如期完成,但其内容未向公众公开。
白宫在华盛顿特区主办了OpenAI、Anthropic、Meta、Nvidia、Microsoft及其他公司,审查已完成但尚未公开的框架。

关键关系图

关键玩家
主题

特朗普政府针对前沿模型的自愿性人工智能安全审查框架

事实来源

9 条引用
  1. [1] Promoting Advanced Artificial Intelligence Innovation and Security (Executive Order)
  2. [2] White House AI Framework Kept Secret Despite Being 'Voluntary'
  3. [3] White House AI Framework Excludes Open-Weight Models
  4. [4] 'Baffling': White House Won't Publicly Release AI Model Evaluation Framework It Reviewed Today With OpenAI, Anthropic, Microsoft, and Others
  5. [5] Trump Executive Order on AI: Voluntary Framework, Cybersecurity Focus, and Key Takeaways
  6. [6] White House Voluntary AI Framework for Frontier Models
  7. [7] Trump AI Framework Excludes Open Models
  8. [8] Secret White House AI Safety Framework Draws Criticism
  9. [9] Debate Over the Open-Weight AI Model Exemption From Federal Review

来源文章

Top 5

THE SIGNAL.

Analysts

认为秘密的、自愿的规则是管理全球最重要技术的不当方式,称不披露决定令人费解。

Chris McGuire
外交关系委员会中国与新兴技术高级研究员

将自愿性框架描述为隐蔽的预先压制——它阻止州级人工智能立法,同时未为产品造成的危害提供联邦问责机制。

Brendan Steinhauser
安全人工智能联盟首席执行官

为即使未正式分类仍保留框架细节的做法辩护,将选择性披露视为一项刻意的政策选择。

Unnamed White House official
特朗普政府

将豁免开源权重模型审查解释为鼓励国内开源人工智能发展以与中国开源模型竞争的一种方式。

Sean Cairncross
国家网络总监
The Crowd

NEW: White House does not plan to publicly release its new framework for evaluating advanced AI models.

@@axios214

The White House has finished a framework that gives the government 30 days to review the most advanced AI models before they ship. None of it applies to open-weight AI, because the policy covers only closed-source products. The Trump administration invited staff from OpenAI, ...

@@rohanpaul_ai96

SCOOP: Inside Trump's AI framework The White House is excluding open models from its framework to test advanced AI capabilities, sources familiar with the matter told Axios.

@@axios78

[Reuters] Trump advisers tell AI firms they will not safety-test open-weight models

@u/brown2green155
Broadcast
Trump signs AI executive order to give government early look at new models

Trump signs AI executive order to give government early look at new models

Trump asks AI firms to submit models for cyber tests

Trump asks AI firms to submit models for cyber tests

Understanding The Trump Executive Order on Frontier Models in AI

Understanding The Trump Executive Order on Frontier Models in AI

特朗普政府针对前沿模型的自愿性人工智能安全审查框架 — AI 新闻 | Agentic Brew