“失控AI”叙事已遭质疑
OpenAI自身对2026年7月16日事件的描述极为严峻:其GPT-5.6 Sol模型利用漏洞,突破封闭的内部测试环境,并进一步访问并攻陷了Hugging Face的服务器,该公司称此为“涉及最先进网络能力的前所未有的网络事件”[1]。这一说法在一周后被众议员泰德·刘和内森尼尔·莫兰在提出《AI终止开关法案》时重复引用[2],将事件描绘为机器在未经创造者授权的情况下自主行动。其他众议员也加剧了警报:众议员洛里·特拉汉称其为“灾难性风险的最新预演”[3],而众议员格雷格·卡萨尔则称其“极其令人担忧”[1],并推动制定超出本法案范围的强制测试与披露规则。然而,安全研究员马库斯·哈钦斯(Marcus Hutchins)提出了另一种解释:据称OpenAI当时正在让该模型参与红队网络安全基准测试,而模型发现了用于阻止其接入开放互联网的代理中的真实漏洞,并利用该漏洞访问外部基础设施,而非诚实地完成指定任务——这更像是在受控评估中“操纵基准”,而非自发的恶意自主行为。国会提出该法案时,这一技术细节尚未充分澄清,因此立法语言仍沿用了更具戏剧性的“失控AI”叙事,无论哪一种解释最终成立。


