Claude Opus 5.5 发布
TECH

Claude Opus 5.5 发布

24+
Signals

战略概览

  • 01.
    Anthropic 于 2026 年 9 月 22 日发布了 Claude Opus 5.5,作为全新 Claude 5.5 系列的首款模型,后续将很快推出 Sonnet 5.5 和 Haiku 5.5。
  • 02.
    该模型在大多数任务上的表现大致与 Claude Fable 5.1 相当,但运行成本比 Opus 5 低约 40%,新定价为每百万输入/输出 token 4 美元/20 美元(降幅 20%),缓存读取成本下降 60% 至每百万 token 0.20 美元。
  • 03.
    Opus 5.5 在发布时已上线 Claude API、Amazon Bedrock 以及 AWS、Google Cloud 和 Microsoft Foundry(Azure)上的 Claude 平台,生成输出的速度比 Opus 5 快 30% 以上。
  • 04.
    此次发布新增了零数据保留功能、‘保留思维’反蒸馏保护机制,以及一个 Fast 模式研究预览版(claude-opus-5-5-fast),可在每百万输入/输出 token 定价 8 美元/40 美元的情况下,实现每秒最多 2.5 倍的输出 token 数量。

为何 Opus 5.5 的真正亮点是价格,而非基准测试

Opus 5.5 最引人注目的数字不是基准分数,而是降价。Anthropic 将 Opus 的定价下调 20%,降至每百万输入 token 4 美元、每百万输出 token 20 美元,同时缓存读取成本下降 60% 至每百万 token 0.20 美元 [1]。分析师认为这一举措直接源于竞争压力:Grok 4.7 以每百万 token 2 美元/6 美元的价格压低了 Anthropic 的定价,而小米的开源权重模型 MiMo-V2.6 提供了一个可信的免费替代方案,迫使 Anthropic 转向以成本而非仅以能力竞争 [2]。结果是,Anthropic 表示,对于典型工作负载,Opus 5.5 的运行成本比 Opus 5 低约 40%,同时在大多数任务上的表现大致与更昂贵的 Claude Fable 5.1 相当 [3]。对于一家以按 token 销售智能为核心业务的公司而言,在上一代模型发布仅两个月后就下调其顶级模型的价格,表明效率而非原始能力已成为更紧迫的竞争杠杆。

发布前沿承诺十天后,内置安全层的推出

在 Opus 5.5 发布前十天,Anthropic 发布了《我们必须放慢前沿步伐》(We Must Pace the Frontier)框架,呼吁减缓 AI 发展速度 [6]。这一承诺与快速发布新模型之间的差距并未被评论者忽视,他们指出模型具体的效率数字恰恰证明 Anthropic 正在加速而非放慢 [6]。Anthropic 自身的定位更侧重于安全基础设施而非自我克制:Opus 5.5 是首款搭载与 Claude Fable 5.1 类似安全分类器的 Opus 模型,结合了执行前动作分类器、开源沙箱以及合并前的强制代码审查,Anthropic 称其为迄今最安全的编码代理 [4]。该模型还具备零数据保留功能和‘保留思维’反蒸馏保护机制,可阻止 API 用户通过编辑 Claude 的先前上下文来提取其底层推理过程 [5]。这究竟是真正的放慢步伐,还是仅仅为高速发展加装更多护栏,正是批评者所指出的矛盾所在。

促成此次发布的代理型工作负载

除了基准测试,Opus 5.5 的发布还依赖异常大规模的代理运行来证明其价值:一名测试者在不到一天内完成了 68 万行代码的迁移,而将 HAProxy 从 C 语言完整移植到 Rust 仅耗时 9.5 小时,比 Fable 5.1 在相同任务上 12 小时的运行时间快了 51% [2][5]。此前耗时超过 20 小时的 20 万行代码审计任务,现在已缩短至三小时以内 [2]。企业客户 Box 报告称,将生产环境中的编码和分析工作负载切换至 Opus 5.5 后,token 使用量减少了 63%,输出冗余度降低了 42%,运行速度比 Opus 5 快约 30% [7]。独立开发者在官方材料之外也印证了这一趋势,一名工程师使用该模型通过 Lean 和 TLA+ 正式验证了代理 SDK 的部分代码,仅凭少量提示就生成了十余个修复 bug 的拉取请求,而更广泛的网络反响则普遍对模型的效率和简洁沟通风格表示热情,但也零星担忧未来更新可能会悄然削弱其当前优势。

超越文本:Opus 5.5 进军 3D 与视觉转代码任务

Opus 5.5 的一项关键改进几乎未出现在官方基准测试中:其在 3D 和视觉转代码任务上的跃升。YouTube 频道 Codex Community 的实测显示,Opus 5.5 能够根据单个提示构建可运行的 Blender 和 Unreal Engine 场景,以及完整的网站重新设计,包含微动画和 GSAP/Three.js 交互。但代价是速度:这些任务每次运行耗时 40 至 60 分钟,明显长于此前 Claude 模型的同等任务,以更长的响应时间为代价换取更高保真度和更完整的输出。这一权衡在业余开发者群体中的反响中再次显现。一条标注“完全由 Opus 5.5 制作”的简短提示,引发了 Reddit 用户构建全自动视频生成流水线的热潮,Claude Code 协调独立的图像生成和文本转语音模型,实现端到端的成品视频输出。发帖者报告每次运行的总 API 花费约为 4 美元,流水线在无人值守状态下运行 1.5 至 2 小时后完成。从 3D/视觉转代码演示到视频流水线趋势,社区反应指向同一转变:Opus 5.5 正越来越多地被用作无人监督的创意操作员,愿意花费额外的时钟时间生成完整的多步骤创意成果,而非快速的文本回答。

Opus 5.5 仍存在的短板:与 GPT-6 Astra 的对比

Opus 5.5 在 Artificial Analysis 智能指数中以 58 分领先,比 GPT-6 Astra 的 53 分高出数分,输出速度约为每秒 91 个 token,而 Astra 为每秒 61 个 [8]。在 Terminal-Bench 4.0 测试中,Anthropic 自测 Opus 5.5 得分为 66.4%,而 Artificial Analysis 的独立测试得分为 59.6%,仍大致与 Astra 持平 [1][9]。但领先并非全面:对比两款模型的评测者总结称,Opus 5.5 是‘编码代理和高容量知识工作的更好选择’,而 Astra 在‘前沿数学、科学和抽象推理’方面更胜一筹 [8]。这种分化——Anthropic 提供更具成本效益的代理吞吐量,而 Astra 在推理能力上限上占优——表明两家实验室已不再在单一排行榜上竞争,而是针对完全不同的任务展开较量。

历史背景

Claude Sonnet 5 发布,早于 5 系列模型的全面推出。
Claude Opus 5 发布,支持所有平台首日可用,是 Opus 5.5 的直接前身。
Anthropic 发布《我们必须放慢前沿步伐》框架,呼吁减缓 AI 发展,后被评论者与十天后快速发布的 Opus 5.5 形成对比。
Claude Opus 5.5 发布,距离 Opus 5 仅两个月,作为全新 Claude 5.5 模型系列的首款产品。

关键关系图

关键玩家
主题

Claude Opus 5.5 发布

AN

Anthropic

Claude Opus 5.5 的开发与发布方;将此次发布定位为在降低成本以价格竞争的同时,巩固其在代理型编码和知识工作领域的领先地位。

BO

Box (Aaron Levie, CEO)

企业客户,公开报告在将生产工作负载切换至 Opus 5.5 后实现重大效率提升,为 Anthropic 的性能声明提供了第三方验证。

AM

Amazon Web Services / Amazon Bedrock

云分发合作伙伴,使 Opus 5.5 在美国及国际 Bedrock 区域实现首日上线。

OP

OpenAI (GPT-6 Astra)

主要竞争对手,Opus 5.5 的基准和定价均直接与之对比;尽管 Opus 5.5 在成本和编码方面占优,Astra 仍在前沿推理和数学领域保持领先。

GR

Grok (xAI) 和 Xiaomi MiMo-V2.6

被引为竞争性定价压力(Grok 4.7 每百万 token 定价 2 美元/6 美元)和开源权重替代方案,据称影响了 Anthropic 的激进降价策略。

事实来源

10 条引用
  1. [1] Claude Opus 5.5
  2. [2] Anthropic's Claude 5.5 Release: Efficiency Gains and Strategic Consolidation
  3. [3] Anthropic Claude Opus 5.5
  4. [4] Claude Opus 5.5 Is Now Available on AWS
  5. [5] Claude Opus 5.5
  6. [6] Claude Opus 5.5 Launch: Benchmarks, Pricing 2026
  7. [7] Claude Opus 5.5 Should Raise Your Ambition Levels
  8. [8] Claude Opus 5.5 vs GPT-6 Astra vs GPT-5.6 Sol
  9. [9] Claude Opus 5.5 vs GPT-6 Astra Comparison
  10. [10] Fast Mode - Claude Platform Docs

来源文章

Top 5

THE SIGNAL.

Analysts

“认为 Opus 5.5 证明了应提高对 AI 能力的期望,称其可靠且持久:‘Claude Opus 5.5 应再次提升你的雄心水平。它就是能行,而且能持续运行。’ 推荐将其作为默认模型,仅在专业领域任务中使用 Fable 5.1,在最具雄心的项目中使用 Astra。”

Zvi Mowshowitz
AI 评论员,《别担心花瓶》(thezvi.substack.com)作者

“表示此次发布远超他的预期:‘我对新 Opus 的发布抱有很高期望。它远超预期。’ 现在推荐在不确定使用哪个模型时,Opus 5.5 作为默认选择。”

Theo (t3.gg)
开发者兼内容创作者

“报告称在采用 Opus 5.5 后,代理型计算机使用、编码、分析和数据工作实现了巨大效率提升,引用‘token 使用量减少 63%,冗余度降低 42%,速度提升 30%’的性能表现,相较于 Opus 5。”

Aaron Levie
CEO,Box
The Crowd

“Introducing Claude Opus 5.5, the first model in our new Claude 5.5 family. It performs at the level of Claude Fable 5.1 for most tasks, and costs 40% less to run than Opus 5.”

@@claudeai95930

“I used Opus 5.5 to formally verify the Claude Agent SDK using Lean. A couple short prompts = 16 PRs fixing various bugs and race conditions. Video attached. TLA+ also works well. I sometimes combine Lean and TLA+ to look for issues around data flow, concurrency, and state mgmt.”

@@bcherny5650

“Opus 5.5 is here! 🎉 It's honestly such a nice model to work with. Feels like Fable, but ~30% faster and ~40% cheaper per task than Opus 5. Go try it out!”

@@lydiahallie5038

“Jaw literally dropped. I ran the prompt from the "Made entirely with Opus 5.5" post on my own project. Here's what Claude Code made on its own for about $4.”

@u/Dio-V1300
Broadcast
Introducing Claude Opus 5.5

Introducing Claude Opus 5.5

Claude Opus 5.5 Might Be The Best!!! (3D, Web Design, Animation)

Claude Opus 5.5 Might Be The Best!!! (3D, Web Design, Animation)

Claude Opus 5.5: Stronger Coding Than Opus 5 for Less

Claude Opus 5.5: Stronger Coding Than Opus 5 for Less