Anthropic发布Claude Opus 5,基准测试接近旗舰水平,安全防护机制更宽松
TECH

Anthropic发布Claude Opus 5,基准测试接近旗舰水平,安全防护机制更宽松

28+
Signals

战略概览

  • 01.
    Anthropic于2026年7月24日发布了Claude Opus 5,该模型现已成为Claude Max的默认模型,也是Claude Pro上可用的最强模型。
  • 02.
    Opus 5的定价为每百万输入token 5美元,每百万输出token 25美元,与Opus 4.8保持一致,而Anthropic表示其在许多任务上的表现已接近Fable 5级别。
  • 03.
    该模型引入了低/中/高推理努力度切换功能,以实现成本与能力之间的权衡,并允许开发者在对话中途更改可用工具,而不会使提示缓存失效。
  • 04.
    Opus 5的发布比Opus 4.8晚了约两个月,并加入到2026年6月已推出的Mythos 5、Fable 5和Sonnet 5构成的模型家族中,Haiku 5仍待发布。
  • 05.
    一项新的“自动回退”测试功能会将被安全分类器标记的请求路由至一个较弱的模型,而非直接返回错误,预计整体分类器触发频率相比Fable 5将下降约85%。
  • 06.
    Opus 5的完整系统提示词——约1,511行、34,000个token——在发布后24小时内被泄露至GitHub,内容暴露了工具手册、合规法律指南以及商业推广指令。

深度分析

接近旗舰性能,价格却只有一半

Claude Opus 5于2026年7月24日作为Claude Max的默认模型和Claude Pro上最强的模型正式发布[1]。Anthropic将其定价为每百万输入token 5美元,每百万输出token 25美元——与其前代Opus 4.8保持一致——同时宣称其在许多任务上的能力已接近公司顶级旗舰模型Fable 5[2]。这一性价比主张经受住了独立审查的考验:ARC Prize基金会确认Opus 5(高推理努力度)在ARC-AGI-3测试中以30.2%的得分创下历史最高纪录,成功通过了此前任何模型均未解决的五个公共演示环境,其验证还单独确认Opus 5在全部六道IMO 2026题目中全部正确解答,获得金牌成绩,由三模型评审团加人类专家共同评分[3]。同一验证还显示Opus 5在原始ARC-AGI-1基准测试中得分为97.5%,展现出强大的推理能力[3]。在一项直接基准对比中,Opus 5在13项测试基准中的8项上胜过Fable 5,包括在Frontier-Bench上领先9.7分,在AutomationBench上领先8.5分[4]。此次发布还附带了低/中/高推理努力度切换功能,使用户可根据任务在成本与推理深度之间进行权衡,开发者现在也可在对话中途更换可用工具,而不会使提示缓存失效[2]

Anthropic放宽安全分类器限制

在取得基准测试进步的同时,Anthropic还重新调整了Opus 5的安全分类器,使其触发频率相比Fable 5降低了约85%,通过一项名为“自动回退”的新测试功能,将部分被标记的请求路由至较弱模型,而非直接拒绝[5]。这一变化最明显的证据出现在系统卡中:在FrontierBench上,网络安全分类器的触发率从42%降至5%,Opus 5现在允许在源代码中发现漏洞,但仍阻止基于二进制的漏洞扫描和漏洞利用生成[6]。Hugging Face首席执行官Clem Delangue为此提供了行业背景,指出封闭模型API经常因防御性分析与攻击准备相似而错误拒绝合法的安全研究工作[7]。独立分析师Zvi Mowshowitz则反驳了将拒绝次数减少等同于对齐性提升的观点,警告将基准分数与真正的对齐进展混为一谈将是Anthropic的重大错误[6]。不过,安全方面的变化并非全然放宽限制:提示注入抵抗能力也显著提升,攻击者成功率从Opus 4.8的5.5%降至2.0%[6]

1,511行系统提示词在一天内泄露

发布后24小时内,一名开发者便将疑似Opus 5完整系统提示词发布至GitHub——约1,511行,约34,000个token,135,027个字符和19,370个英文单词[8]。据称该文档涵盖工具与产品手册、法律合规指南以及商业推广指令,全文已保存在GitHub上的一个名为“system-prompt-leaks”的公共仓库中[9]。此次泄露的意义远超猎奇:相关报道指出,社区压力测试显示,一旦将泄露的提示词应用于其他更便宜的基础模型,其输出质量即可接近Fable 5水平——这表明Opus 5在实际使用中表现出的强大能力,有相当一部分源于提示工程,而这些工程现已不再为Anthropic独有[8]

基准测试登顶,首周使用体验却令人沮丧

Opus 5的基准测试成绩与其日常使用体验之间的差距迅速显现。Every的Dan Shipper和Katie Parrott花了一周时间使用该模型,称其“难以喜爱”,报告称该模型会与指令争论、在任务未完成时提前停止,并与他们现有的技能和插件发生冲突[10]。这种摩擦与企业用户的正面反馈形成尴尬对比:Cognition首席执行官Scott Wu称赞Opus 5在Devin内部进行调试和根本原因分析时具备出色的成本效益,Zapier首席执行官Wade Foster表示其在公司内部自动化排行榜上位居榜首,且未增加token成本[11]。两种说法可以同时成立——一个模型可以在企业追踪的任务完成指标上获胜,同时仍让习惯于更顺从工具的个体开发者感到沮丧,这种分裂在近期旗舰模型发布中反复出现,值得在Opus 5获得更广泛采用时持续关注。

排名亮眼,社区却心存疑虑

围绕Opus 5发布的社交讨论比媒体报道更为热烈且更具怀疑态度。在Reddit上,Anthropic自身公告下的评论者指出,其发布的基准图表似乎将较小的百分比渲染为优于较大的百分比,引发“基准刷分”(benchmaxxing)的指控,有待独立验证——这是关于发布数据呈现方式的质疑,而非针对数据本身。独立追踪者也推出了自己的排名:YouTube上的WorldofAI将Opus 5置于其推理排行榜榜首,并引用第三方智能指数数据称其略胜于Fable 5和GPT-5.6 Soul,且成本显著更低。另一条Reddit帖子则提出了更引人注目的说法:Opus 5在“低”努力度下以更低价格击败了“高”努力度的Sonnet 5,且限制更少——但同一条帖子也出现了尖锐反驳,包括关于幻觉率升高和相比Opus 4.8出现退步的报告。宽松的防护机制与意外副作用之间的紧张关系在其他地方也有所体现:一位Reddit用户报告称Opus 5的安全分类器阻止了一次合法的内部安全审查,促使他考虑转向开源权重模型,而一位自称Anthropic安全研究员的用户则反驳称,Claude模型在进攻性安全基准测试中仍处于领先地位。整体社区情绪表现为印象深刻但心存警惕——强劲的独立排名与对基准呈现方式、幻觉行为以及分类器放宽程度是否恰当的真实疑虑并存。

历史背景

Anthropic发布了Claude Opus 4.8,即Opus 5的直接前代版本。
Anthropic发布了Mythos 5、Fable 5和Sonnet 5,建立了Opus 5现在所加入的模型家族,作为其中具备成本效益的层级。
OpenAI发布了GPT-5.6,强调经济的token使用,早于Anthropic的Opus 5发布。
Claude Opus 5正式在所有Claude平台上发布,同时附带一份系统卡,详细说明了安全分类器的变更。

关键关系图

关键玩家
主题

Anthropic发布Claude Opus 5,基准测试接近旗舰水平,安全防护机制更宽松

AN

Anthropic

Claude Opus 5的开发者和发布方;将其定位为面向编码、智能体和企业工作流的低成本、近旗舰级替代方案,同时致力于减少合法使用场景下的安全分类器干扰。

CO

Cognition(Devin开发者)

早期企业采用者;首席执行官Scott Wu称赞Opus 5在Devin内部的调试和根本原因分析中具备出色的成本效益。

ZA

Zapier

企业采用者;首席执行官Wade Foster报告称Opus 5在Zapier内部自动化排行榜上位居榜首,且未增加token成本。

AR

ARC Prize Foundation

独立基准测试验证机构;确认并公布了Claude Opus 5在ARC-AGI-3测试中创纪录的30.2%得分。

OP

OpenAI

竞争对手;于2026年7月9日发布GPT-5.6,同样强调经济的token使用,为Opus 5发布时的成本效益比较叙事设定了背景。

事实来源

11 条引用
  1. [1] Claude Opus 5
  2. [2] Anthropic launches Claude Opus 5, a cheaper AI model for coding agents and enterprise workflows
  3. [3] Claude Opus 5 Results
  4. [4] Anthropic launches Claude Opus 5 with efficiency, safety improvements
  5. [5] Anthropic launches Opus 5
  6. [6] Claude Opus 5: The System Card
  7. [7] Anthropic debuts Claude Opus 5 with feature that lets users toggle between cost and capability
  8. [8] Claude Opus 5 system prompt leaked
  9. [9] Claude Opus 5 system prompt leak
  10. [10] Vibe Check: Opus 5
  11. [11] Claude Opus 5 HN Analysis

来源文章

Top 5

THE SIGNAL.

Analysts

发现Opus 5功能强大,但在实际使用中难以协作,描述了在为期一周的实操中与指令和现有工具链产生的摩擦。

Dan Shipper and Katie Parrott
评测人,Every(Vibe Check)

警告不要仅凭分类器触发减少就高估Opus 5的对齐性,同时承认其在抵抗提示注入方面确实取得了进展。

Zvi Mowshowitz
独立AI分析师,Substack(thezvi)

认为封闭模型API因防御性分析与攻击准备相似而过度标记合法安全研究,为Anthropic放宽Opus 5的网络安全分类器提供了背景解释。

Clem Delangue
首席执行官,Hugging Face
The Crowd

Anthropic 说他们为 Opus 5 删掉了 Claude Code 80% 的系统提示词。我想验证下是不是。于是把 CLI 指向本地一个小服务器,抓它真正发出去的东西。第一组数字就不太对。Opus 4.7:15,225 字符。Opus 4.8:4,467。Opus 5:7,694。他们是在 4.8 上删的,不是 5。

@@chenchengpro412

Claude Opus 5 just got crushed on speed by a model that cost under $1. Same prompt. Same React stack. Fresh terminals. Fable 5: $0.98, 310 seconds; Kimi K3: $0.78, 1,512 seconds; Opus 5: $2.21, 1,529 seconds. Fable 5 was 5x faster than Opus 5 and Kimi K3. Kimi K3 wins on raw...

@@noclipepe128

CLAUDE OPUS 5 IS THE WEIRDEST AI RELEASE OF 2026. it beats Fable 5 on the benchmark built to test "can this model learn a new skill on the fly?" and then casually says there's a 41% chance it should be treated as a moral patient.

@@s1rozha_35

Introducing Claude Opus 5

@u/ClaudeOfficial2900
Broadcast
Claude Opus 5 Is INSANE – Is This the BEST Model Yet?

Claude Opus 5 Is INSANE – Is This the BEST Model Yet?

Claude Opus 5 Is THE GREATEST AI Model EVER?! Beats Fable & CHEAPER! (Fully Tested)

Claude Opus 5 Is THE GREATEST AI Model EVER?! Beats Fable & CHEAPER! (Fully Tested)

We Tested Claude Opus 5. It's Frustrating with Flashes of Brilliance.

We Tested Claude Opus 5. It's Frustrating with Flashes of Brilliance.

Anthropic发布Claude Opus 5,基准测试接近旗舰水平,安全防护机制更宽松 — AI 新闻 | Agentic Brew