‘重大’究竟意味着什么——以及为何此前从未有模型跨越此线
自2025年4月版本2修订以来,OpenAI的《准备度框架》一直设有‘重大’网络安全层级,但在Astra出现之前,它只是一个理论上的上限,而非对实际模型的描述[5]。该门槛具体且严苛:一个被评为‘重大’的系统必须能够在无人干预的情况下,识别并开发针对加固现实关键系统的、涵盖所有严重等级的功能性零日漏洞;或仅凭一个高层目标,独立设计并执行整套新型网络攻击行动[3]。这与OpenAI以往发布的任何产品在能力上存在实质性差异。截至2026年,该公司最强大的公开模型GPT-5.6 Sol、Terra和Luna均处于‘高’层级;特别是GPT-5.6 Sol,在标准配置下无法针对广泛使用的加固软件生成功能性‘重大’级别漏洞[7]。独立于OpenAI自身声明之外的评论也支持这一点:YouTube频道Smart AI Hustle指出,此前没有任何一款OpenAI模型(包括GPT-5.6 Sol)曾触发过‘重大’网络威胁阈值,这印证了公司新闻稿中‘首次’说法的外部可信度。
Astra披露之所以引人注目,不仅在于评分本身,更在于其初步性质。OpenAI表示基准测试仍在进行中,目前仅‘无法排除’其获得‘重大’评级的可能性——这是一种谨慎措辞,而非确认——但根据框架自身的规则,一旦这种可能性变得可信,就必须立即采取预防性措施[2]。这可以说是对其自愿性内部安全承诺是否真正能约束实验室路线图的一次现实考验,而不仅仅停留在网站页面上。


