封装即安全机制
Claude Mythos 5 与普遍可用的 Claude Fable 5 被描述为同一底层模型,Fable 5 针对双重用途能力增加了额外的安全措施,而 Mythos 5 则没有 [1]。正是这一差距决定了 Claude Security 的设计方式:产品并未向企业客户开放自由输入提示词的界面,而是返回结构化的扫描结果,包括按 CWE 类别、严重性、置信度评级分类的发现,以及需人工审核后才能部署的修复建议 [2]。由于不存在自由文本交互界面,该模型在架构上被阻止被引导去编写漏洞利用代码。
这种通过产品设计实现的限制,实际上也是一种变现机制,社区对此反应中已体现出张力。Reddit 的 ClaudeAI 社区在经历长时间评论讨论后,普遍认为 Anthropic 并未向任何人(无论是企业还是其他用户)开放原始的 Mythos 5 访问权限;它只是一个具有固定工作流程的狭义应用场景,与无限制的模型访问相去甚远。讨论中一个明显的潜流是,对 Mythos 早前‘过于危险,无法公开发布’的描述,是否实际上为这种仅限扫描、付费访问的层级做了铺垫。Payward 联合首席执行官 Arjun Sethi 对同一产品决策持更乐观的看法,他认为前沿 AI 颠覆了传统的攻击者/防御者不对称性,因为模型现在可以像攻击者一样以机器规模阅读每一行代码 [3]。


