从即时回答到真正思考:为何模型升级至关重要
直到本周,所有与 Claude 的语音对话都运行在 Haiku 模型上,这是 Anthropic 最小、最快的模型,优先考虑即时回复而非深度推理[1]。新的语音模式允许用户在对话中途切换至 Sonnet 或 Opus,选择这些模型后,对话将真正通过所选模型处理,而不会像以前那样悄悄回退到 Haiku[2]。这些模型在原始能力上并无巨大差异——根据 Fireship 的说法,Sonnet 在编码基准测试中的表现可达 Opus 的 95% 至 99%,但成本仅为后者的一小部分[2]。然而,此前仅限 Haiku 的设置虽然适用于简单快速的问题,但在处理更复杂请求时表现吃力[8],这种限制本质上排除了 Claude 文本界面长期以来提供的多步骤推理能力。现在,付费账户默认使用用户上次在文本聊天中使用的模型,使推理深度在不同交互模式间保持一致,而非在麦克风前重置[2]。



