‘关键’级网络能力分类及其实际限制
OpenAI于2026年9月3日至4日发布的GPT-6 Astra,是首个在其“准备度框架”下达到‘关键’级网络安全能力的模型,能够在无需人类逐步指导的情况下发现并利用加固目标中的新型漏洞 [1]。若无生产级防护措施,该模型在ExploitBench上得分为100%,而前代GPT-5.6 Sol仅为78.5%;在ExploitGym上得分为42.4%,而Sol为30.3%;在发布前测试中还发现了两个此前未知的零日漏洞,OpenAI正将这些信息告知受影响的软件厂商 [2]。OpenAI的应对策略是分级访问而非完全封锁:公开发布的Astra仅限于安全代码审查与修复,拒绝概念验证型漏洞利用请求;而能力更强的版本则仅通过公司的Daybreak项目提供给经过审核的防御方 [2]。一位安全分析师指出,真正值得关注的是标签本身——Astra现在是唯一一个企业可依据公开阈值验证其网络能力的前沿模型,而非孤立地被视为一种新威胁 [3]。


