“更便宜的编码之王”宣传背后有个星号注释
Anthropic将Claude Sonnet 5.5宣传为更便宜的编码冠军:它在Terminal-Bench 4.0上得分为70.6%,优于Opus 5.5的66.4%,远超Sonnet 5的10.3%,同时每令牌成本减半——每百万2美元/10美元,对比Opus 5.5的每百万4美元/20美元[1]。Anthropic及其企业合作伙伴将此视为明确胜利:得益于更少的工具调用,输出速度快达30%,每项任务成本降低最多30%[2]。但这一宣传存在一个漏洞。独立基准测试公司Artificial Analysis发现,在最大推理强度下,Sonnet 5.5在每个Intelligence Index任务中生成了约19.3万个输出令牌——这是该公司对任何模型测得的最高值,比Opus 5.5完成相同任务所需多出约60%[3]。在此强度层级,“价格减半”的计算大幅缩水:相比Opus 5.5,每项任务多消耗约60%的令牌严重削弱了Sonnet 5.5的每令牌价格优势,即使其名义费率仍仅为Opus 5.5的一半[4]。



