接近旗舰性能,价格却只有一半
Claude Opus 5于2026年7月24日作为Claude Max的默认模型和Claude Pro上最强的模型正式发布[1]。Anthropic将其定价为每百万输入token 5美元,每百万输出token 25美元——与其前代Opus 4.8保持一致——同时宣称其在许多任务上的能力已接近公司顶级旗舰模型Fable 5[2]。这一性价比主张经受住了独立审查的考验:ARC Prize基金会确认Opus 5(高推理努力度)在ARC-AGI-3测试中以30.2%的得分创下历史最高纪录,成功通过了此前任何模型均未解决的五个公共演示环境,其验证还单独确认Opus 5在全部六道IMO 2026题目中全部正确解答,获得金牌成绩,由三模型评审团加人类专家共同评分[3]。同一验证还显示Opus 5在原始ARC-AGI-1基准测试中得分为97.5%,展现出强大的推理能力[3]。在一项直接基准对比中,Opus 5在13项测试基准中的8项上胜过Fable 5,包括在Frontier-Bench上领先9.7分,在AutomationBench上领先8.5分[4]。此次发布还附带了低/中/高推理努力度切换功能,使用户可根据任务在成本与推理深度之间进行权衡,开发者现在也可在对话中途更换可用工具,而不会使提示缓存失效[2]。


