Claude Opus 5 发布
TECH

Claude Opus 5 发布

74+
Signals

战略概览

  • 01.
    Anthropic 于 2026 年 7 月 24 日正式发布 Claude Opus 5,将其定位为在价格仅为 Fable 5 一半的情况下,性能接近 Fable 5 前沿智能水平的模型。
  • 02.
    Opus 5 的定价为每百万输入 token 5 美元,每百万输出 token 25 美元,与 Opus 4.8 保持一致,仅为 Fable 5 费率的一半;Fast 模式定价为 10/50 美元,速度约为 2.5 倍。
  • 03.
    Opus 5 已成为 Claude Max 的默认模型,也是 Claude Pro 上可用的最强模型,用户可通过 Claude API、Claude.ai、Claude Code 和 Claude Cowork 立即使用,模型 ID 为 claude-opus-5。
  • 04.
    Anthropic 新增了一个努力程度调节选项(低/中/高),允许用户根据每次请求在成本与能力之间进行权衡,回应了企业对 AI 支出的担忧。
  • 05.
    Opus 5 在 Frontier-Bench v0.1 上创下新的最先进分数,成绩超过 Opus 4.8 的两倍,并在 ARC-AGI-3 上得分约为次优模型的三倍。
  • 06.
    Opus 5 是 Anthropic 在不到两个月内发布的第四款模型,紧随 2026 年 6 月发布的 Mythos 5、Fable 5 和 Sonnet 5 之后。
  • 07.
    Claude Opus 5 同时在 Amazon Bedrock 和 AWS 上的 Claude Platform 上线,默认对企业客户零数据保留,并向 GitHub Copilot 的 Pro+、Max、Business 和 Enterprise 用户推出。
  • 08.
    Opus 5 显著降低了提示注入攻击的成功率:在启用 Auto Mode 的浏览器代理测试中,其在 129 个环境中的攻击成功率为 0%,而 Opus 4.8 在无防护措施下的成功率为 31.5%。

以半价取代 Fable 5 的旗舰模型

Anthropic 于 2026 年 7 月 24 日发布 Claude Opus 5,定位为‘在价格仅为 Fable 5 一半的情况下,接近 Fable 5 前沿智能水平’的模型 [1]。定价是字面意义上的:Opus 5 每百万输入 token 收费 5 美元,每百万输出 token 收费 25 美元——与 Opus 4.8 相同,仅为 Fable 5 输入费率的一半;Fast 模式定价为 10/50 美元,速度约快 2.5 倍 [2]。性能差距比价格差距更小:在 Frontier-Bench v0.1 上,Opus 5 得分为 43.3%,而 Fable 5 为 33.7%,GPT-5.6 Sol 为 34.4%,Opus 5 的分数超过 Opus 4.8 的 18.7% 一倍以上 [2]。在 ARC-AGI-3 上,Opus 5 得分为 30.2%,而 GPT-5.6 Sol 为 7.8% [2],在 GDPval-AA v2 知识工作 Elo 评分中,Opus 5 得分为 1,861,Fable 5 为 1,747 [2]。Opus 5 在某些特定编码测试中略逊一筹——SWE-bench Pro 得分为 79.2%,而 Fable 5 为 80.0% [2]——但在 CursorBench 上,以最大努力运行时,其得分与 Fable 5 的峰值仅差 0.5%,成本却只有其一半,并且在 OSWorld 2.0 计算机使用任务中,以约三分之一的成本击败了 Fable 5 [2]。这种性价比正是引发社区最强烈反应的原因:实际测试者进行的是实用的代理工作流对比,而非仅引用发布图表,同时反复提出一个问题:当更便宜的兄弟模型几乎能匹敌时,Fable 5 还有什么存在的必要?

Opus 5 如何几乎解决了基于浏览器的提示注入问题

Anthropic 发布材料中最具体的安全部分是关于提示注入——即恶意指令隐藏在网页中劫持 AI 代理浏览会话的攻击模式。在通过 Claude Cowork 对 129 个环境进行的测试中,未应用防护措施时,攻击成功率从 Opus 4.8 的 31.5% 降至 Opus 5 的 3.70%,启用 Auto Mode 后进一步降至 0% [3]。在独立的 Gray Swan 间接提示注入基准测试中,攻击者在 15 次尝试内成功的概率从 5.5% 降至 2.0%,单次尝试从 0.5% 降至 0.2% [4]。一家媒体将此描述为 Opus 5 可能解决了‘困扰 AI 代理的最大安全漏洞’,并指出这种提升来自结合输入扫描与动作阻断的多层防御,而非单一修复,而 OpenAI 曾表示提示注入‘可能永远无法完全解决’ [3]。然而,这种改进并非普遍:Anthropic 故意将 Opus 5 在网络安全利用和其他‘高风险、双重用途能力’方面落后于自家的 Mythos 5 模型,通过网络安全验证计划限制高风险用例 [1][5]

努力程度调节:Anthropic 对企业账单焦虑的回应

在定价故事背后,是企业客户对不断上涨的 AI 账单施加的具体商业压力 [6]。Anthropic 的回应是新增一个努力程度调节选项——低、中或高——允许客户根据每次请求在能力与成本之间进行权衡,而非锁定单一价格点 [6][7]。结合标准/Fast 模式(5/25 美元 vs 10/50 美元,速度约快 2.5 倍)[2],企业买家现在拥有两个独立调节旋钮——努力程度与速度——而非单一模型层级。这一功能与企业优先部署措施同步推出:Opus 5 同时在 Amazon Bedrock 和 AWS 上的 Claude Platform 上线,默认零数据保留 [8],并向 GitHub Copilot 的 Pro+、Max、Business 和 Enterprise 用户推出,覆盖 VS Code、Visual Studio、GitHub.com 和 JetBrains,企业管理员需主动启用 [9]。Opus 5 也是 Anthropic 在不到两个月内发布的第四款模型,紧随 2026 年 6 月发布的 Mythos 5、Fable 5 和 Sonnet 5 之后 [6]——这一发布节奏既是对 OpenAI 两周前发布的 GPT-5.6 Sol 的竞争压力回应,也是对企业成本问题的修复 [10]

精心挑选的图表与对齐与基准的争议

并非所有人都对 Opus 5 的发布持乐观态度。AI 分析师 Zvi Mowshowitz 将其描述为一次刻意的中间路线发布:‘Claude Opus 5 试图兼顾两全’ [11]——以 Fable 5 一半的价格实现接近其性能,同时有意不赋予其 Anthropic 为 Mythos 5 保留的更危险推理能力。Mowshowitz 引用评论员 j⧉nus 的观点,特别批评了 Anthropic 对安全基准改进的表述方式:‘优化指标几乎不可避免,但将基准分数与对齐的北极星目标之间的本体论混淆则不然’ [11]。如前所述,Anthropic 在网络安全和双重用途任务上故意让 Opus 5 落后于 Mythos 5 [1][5],这与更广泛社区的怀疑一致,即 Opus 5 与更高层级之间的差距既出于安全考虑,也出于产品差异化目的。争议不在于 Opus 5 的数据是否真实,而在于强提示注入和基准测试分数是否被等同于真正的对齐进展——Mowshowitz 认为 Anthropic 自身的表述模糊了这一区别 [11]

历史背景

Anthropic 在 2026 年 6 月内发布了 Mythos 5、Fable 5 和 Sonnet 5,使 Opus 5 成为其在不到两个月内的第四次模型发布。
Claude Opus 5 以与其前代 Opus 4.8 相同的每百万 token 5/25 美元定价发布,保持 Opus 系列定价不变的同时提升了能力。
GPT-5.6 Sol 在 Claude Opus 5 发布前约两周发布,成为其在编码、推理和知识工作基准测试中的主要对比对象。

关键关系图

关键玩家
主题

Claude Opus 5 发布

AN

Anthropic

模型开发者;发布 Opus 5 作为其新的 Opus 系列旗舰模型,将其定位为对抗自家 Fable 5 和 OpenAI 的 GPT-5.6 Sol,以吸引对成本敏感的企业和编码代理需求。

AM

Amazon Web Services (AWS)

在 Amazon Bedrock 和 AWS 上的 Claude Platform 上提供 Opus 5,覆盖多个地区(美国东部北弗吉尼亚、亚太墨尔本、欧洲爱尔兰/斯德哥尔摩),为企业治理提供默认零数据保留。

GI

GitHub / Microsoft Copilot

在 GitHub Copilot 模型选择器中为 Pro+、Max、Business 和 Enterprise 等级用户添加 Opus 5,覆盖 VS Code、Visual Studio、GitHub.com、JetBrains、Xcode、Eclipse 和移动应用,企业计划需管理员主动启用。

OP

OpenAI (GPT-5.6 Sol)

竞争性前沿模型,于 2026-07-09 发布;Opus 5 在编码、推理和知识工作任务上与其对标,在多数发布基准测试中表现优于它,同时匹配其输入定价并在输出定价上胜出。

事实来源

11 条引用
  1. [1] Introducing Claude Opus 5
  2. [2] Claude Opus 5 Launch Guide 2026
  3. [3] Opus 5 May Have Solved Browser-Based Prompt Injection
  4. [4] Claude Opus 5 Resists Prompt Injection
  5. [5] Anthropic Upgrades Claude With New Opus 5 Model
  6. [6] Anthropic Debuts Claude Opus 5 With Feature That Lets Users Toggle Between Cost and Capability
  7. [7] Anthropic Unveils Claude Opus 5
  8. [8] Introducing Claude Opus 5 on AWS
  9. [9] Claude Opus 5 is Now Available in GitHub Copilot
  10. [10] Claude Opus 5 vs GPT-5.6 Sol
  11. [11] Claude Opus 5: The System Card

来源文章

Top 5

THE SIGNAL.

Analysts

认为 Opus 5 是一次刻意的中间路线发布:以 Fable 5 一半的成本实现接近其性能,但有意未赋予其 Mythos 5 所具备的最危险/高级推理能力;对基准/对齐分数的提升是否真正反映对齐进展表示怀疑。

Zvi Mowshowitz
AI 分析师 / 作家,《Don't Worry About the Vase》(Substack)

警告不要将强基准表现与真正对齐混为一谈,批评 Anthropic 对安全改进的表述方式。

j⧉nus (被 Zvi Mowshowitz 引用)
AI 评论员
The Crowd

Introducing Claude Opus 5. It's a thoughtful and proactive model that comes close to the frontier intelligence of Fable 5 at half the price.

@@claudeai58990

Just over 6 months later, Opus 5 now produces near-superhuman level spreadsheets and slide decks that match what a consultant would make. Things are changing fast.

@@alexalbert__3067

CLAUDE OPUS 5 MIGHT BE THE BIGGEST VALUE UPGRADE IN AI THIS YEAR. Anthropic is claiming something wild: Near Fable 5 performance. At roughly half the cost. If the benchmarks hold up, this changes the economics of building AI agents. Here's what stands out: • Nearly matches [benchmarks continue, truncated by X "Show more"]

@@DamiDefi189

Introducing Claude Opus 5

@u/ClaudeOfficial2800
Broadcast
Opus 5 Just Dropped and Its Numbers Are Legit INSANE

Opus 5 Just Dropped and Its Numbers Are Legit INSANE

What did Anthropic do?! (Opus 5)

What did Anthropic do?! (Opus 5)

I Tested Opus 5 vs. Fable 5. What You Need to Know.

I Tested Opus 5 vs. Fable 5. What You Need to Know.

Claude Opus 5 发布 — AI 新闻 | Agentic Brew