Claude Haiku 5.5 发布
TECH

Claude Haiku 5.5 发布

40+
Signals

战略概览

  • 01.
    Anthropic 于2026年10月7日推出了Claude Haiku 5.5(API标识符为claude-haiku-5-5),称其为迄今为止速度最快、成本最低且能力最强的小型模型,立即在Anthropic自有平台以及AWS、Google Cloud和Microsoft Azure上提供。
  • 02.
    定价采用分级模式:10万token以内的提示,每百万输入/输出token收费$0.10/$0.50;超过该阈值后,价格跃升至$0.50/$2.50——这一低于10万token的费率与OpenAI的GPT-6 Luna持平。
  • 03.
    上下文窗口扩大了五倍,从Haiku 4.5的20万token增至100万token,输出最多可达12.8万token。
  • 04.
    在发布Haiku 5.5的同时,Anthropic还将Claude Sonnet 5.5的缓存读取价格从每百万token $0.20下调至$0.10,预计此举将使大多数代理类工作的成本降低约20%。

10万token的陡坡:多出2%的文本意味着5倍的账单

Haiku 5.5的定价在规格表上看似简单——10万token以内的提示,每百万输入token收费$0.10,每百万输出token收费$0.50 [2]——但这一统一费率在一道硬性门槛处戛然而止。一旦超过10万token,价格便跃升五倍,达到每百万token $0.50输入/$2.50输出 [2]。该模型扩展后的100万token上下文窗口 [3]意味着现在技术上可以输入比该门槛长十倍的提示,这使得在处理长文档、聊天记录或多文件代码库时,很容易意外越过这一阈值。社区讨论中引用的独立测试发现,实际影响极为严苛:仅比10万token多出一点的提示,其成本可能比刚好低于该阈值的提示高出约五倍,尽管实际文本仅增长了几个百分点。一种技术性反驳认为,这一陡坡并非随意设定——它可能反映了真实的推理经济学,即当请求超出模型高效的KV缓存窗口后,预填充(prefill)和解码(decode)成本的扩展方式不同,而较小的模型可能比大型模型更受这种扩展的影响。无论如何,这一陡坡将提示长度的预算管理变成了一项成本控制纪律,而在Haiku 4.5更平缓但更高价的结构下,这一点远没有那么重要。

标价相同,账单不同:为何Haiku 5.5可能比GPT-6 Luna更贵

Anthropic的宣传重点是,Haiku 5.5在10万token以内的提示上与GPT-6 Luna的每token价格持平 [2],但每token价格相同并不等于每任务价格相同。Artificial Analysis发现,在最大努力程度下执行等效的Intelligence Index任务时,Haiku 5.5消耗的输出token大约是GPT-6 Luna的三倍(约16.2万token对比5万token),在一次比较中,这转化为Haiku 5.5每任务成本$0.21,而Luna为$0.07 [5]。这种差距在实验室之外也显现出来:一位独立开发者的相同体素动画渲染任务,据报道在Haiku 5.5上的成本是Luna的十倍以上,尽管标价完全相同,这一结果引发了一场怀疑的社区讨论,尽管批评者质疑具体方法而非直接反驳成本平价的说法。来自多个方向的结论趋于一致——官方基准、独立成本测试和社区反馈:模型的冗长度和努力程度设置对实际支出的影响,远超每token费率表所显示的,而Anthropic自身提出的‘每token便宜90%’(10万token以内)与‘平均便宜75%’(所有请求的综合)这两个说法,已经暗示了这两个数字描述的是不同事物 [3]。

真正能力提升之处:代理式编码与计算机操作,而非琐碎知识

Haiku 5.5背后的基准测试故事,更多关乎特定技能而非通用知识:操作工具和环境。在代理式编码基准测试Terminal-Bench 4.0中,Haiku 5.5得分为39.2%,而Haiku 4.5为0.0%,GPT-6 Luna为16.4% [1]。在OSWorld 2.1计算机操作基准测试中,Haiku 5.5达到72.4%,而此前Haiku和Luna的基线得分在15.7%至48.9%之间 [3]。GDPval-AA v2.1知识基准测试也呈现类似趋势,显示了巨大的代际飞跃——Haiku 5.5得分为1,620,Haiku 4.5为735,且高于Luna的1,437 [3]。Artificial Analysis将这一模式总结为‘高度胜任的代理式知识工作’,但‘事实知识相对较少’且‘幻觉相对较低’ [5]——这是小型模型的经典权衡,即模型被设计为在沙盒任务中可靠执行,而非回忆广泛事实。值得注意的是:几乎所有这些数据都是Anthropic自行报告的数字,在各媒体间被重复引用,而非独立复现。

更低调的举措:Sonnet降价信号着加速的价格战

10月7日,Anthropic对Haiku 5.5的调整并非唯一的价格变动。它还将其Claude Sonnet 5.5的缓存读取价格从每百万token $0.20下调至$0.10,Anthropic预计这将使大多数代理式工作的成本降低约20% [4]。The Decoder将这一捆绑式降价解读为‘几乎可以肯定是对OpenAI更新的GPT-6.1系列的回应’,而非独立的改进 [3],这重新定义了整个Haiku 5.5发布的意义:它不仅是一款新小型模型,更是Anthropic为同时捍卫其小型和中端模型产品线地位而采取的两步定价策略中的一步。结合Haiku 5.5在10万token以内与GPT-6 Luna的价格匹配,这一模式表明,Anthropic与OpenAI之间的小型模型价格战正在加剧而非平息,双方的降价正在触发相邻产品层级的反向降价,而非局限于单一模型。

历史背景

Anthropic发布了Claude Haiku 5.5,取代了Haiku 4.5,上下文窗口从20万token跃升至100万token,并首次在Haiku系列中引入了可调努力程度设置。
Haiku 5.5在Artificial Analysis Intelligence Index上得分为43,比一年前发布的Haiku高出26分,标志着小型模型能力的显著年度跃升。

关键关系图

关键玩家
主题

Claude Haiku 5.5 发布

AN

Anthropic

Claude Haiku 5.5的开发者和发布者;设定定价和定位,直接与OpenAI的GPT-6 Luna竞争,并降低高频率代理式和编码工作负载的成本。

OP

OpenAI (GPT-6 Luna / GPT-6.1系列)

直接竞争对手,其Luna模型被Haiku 5.5作为基准对比对象,并在10万token以内的提示上实现价格匹配;同时Sonnet 5.5的缓存降价被视为对OpenAI更新的GPT-6.1系列的回应。

AW

AWS, Google Cloud, Microsoft Azure

云分发合作伙伴,与Anthropic自有Claude平台一同提供Haiku 5.5。

AS

Asana

企业客户,报告在生产环境中采用Haiku 5.5后,实际延迟和速度有所提升。

RO

Rogo

客户,被引用以验证Haiku 5.5在高频率部署中的准确性与成本权衡。

事实来源

5 条引用
  1. [1] Introducing Claude Haiku 5.5
  2. [2] Anthropic launches Claude Haiku 5.5 with 90% API price reduction, matching GPT-6 Luna
  3. [3] Claude Haiku 5.5 arrives with massive price cuts, proving the AI pricing arms race is far from over
  4. [4] Anthropic releases Claude Haiku 5.5 small model, and halves Sonnet 5.5 cache-read prices
  5. [5] Claude Haiku 5.5 - Intelligence, Performance and Price Analysis

来源文章

Top 5

THE SIGNAL.

Analysts

“认为Haiku 5.5在可信准确性、低成本和速度之间达到了理想平衡,使其能够以高频率运行。”

Alex Wang
Rogo公司代表

“报告在将生产工作负载切换至Haiku 5.5后,延迟和速度有明显提升。”

Aaron Vinh
Asana公司高级软件工程师
The Crowd

“Introducing Claude Haiku 5.5: the cheapest, fastest, and most capable small model we've ever released. On average, it costs around 75% less to run than Claude Haiku 4.5.”

@@claudeai43547

“Claude Haiku 5.5 cost 12x more than GPT-6 Luna for the same scene. Both have the same API price, yet building the same animated voxel 3D pagoda island cost $24.96 on Claude Haiku 5.5 and $1.91 on GPT-6 Luna. Run both models via API -> atomic.chat”

@@atomic_chat_hq2483

“Claude Code subagents bill at Opus rates by default. Haiku 5.5 dropped just now at $0.10 input and $0.50 output per million tokens for requests under 100K tokens, and five times that above. Opus 5.5, the default main model, costs $4 and $20. That's a 40x gap on every helper you...”

@@rryssf123

“Introducing Claude Haiku 5.5: the cheapest, fastest, and most capable small model we've ever released”

@u/ClaudeOfficial2300
Broadcast
Claude Haiku 5.5: Anthropic's New Workhorse.

Claude Haiku 5.5: Anthropic's New Workhorse.

Claude Haiku 5.5 Explained: Everything New

Claude Haiku 5.5 Explained: Everything New

Claude Haiku 5.5 - Pricing and Benchmark | Beats GPT-6 Luna? | Best & Cheapest Model

Claude Haiku 5.5 - Pricing and Benchmark | Beats GPT-6 Luna? | Best & Cheapest Model