为何OpenAI要在自己的模型中设置门禁机制
OpenAI的标准安全过滤器旨在拦截看起来具有恶意意图的网络安全请求,但这一机制同样会阻碍经过审核的防御者合法开展漏洞发现与修复工作 [2]。为此,OpenAI并未对所有用户放宽限制,而是将访问权限划分为两个层级:Daybreak Blue向经批准的安全团队提供专为防御性任务优化的通用GPT-5.6 Sol,适用于漏洞发现、安全代码审查、恶意软件分析、事件响应和补丁验证;而Daybreak Red则是更严格审核的通道,可解锁GPT-5.6-Cyber,用于概念验证漏洞开发、漏洞链验证、渗透测试和红队演练等高风险任务 [1]。
该设计构建了一个“信任阶梯”,而非简单的开关机制。访问权限更高的Red层级需通过身份验证、行为监控、用途限制和法律承诺等多重审核,且自2026年9月1日起,个人账户还需通过硬件安全密钥进行认证 [1]。这种架构使OpenAI能够将其模型中最危险的能力——即支持进攻性安全工作的功能——严格限制在可控的审核流程之后,而非向所有用户发布一个普遍降低安全性的模型。


