Anthropic发布Claude Fable 5.1
TECH

Anthropic发布Claude Fable 5.1

26+
Signals

战略概览

  • 01.
    Anthropic于2026年9月1日发布了Claude Fable 5.1和Claude Mythos 5.1——同一底层模型,但安全分类器强度不同。Fable 5.1已全面上线;Mythos 5.1则仅限于网络安全和生命科学领域的可信访问计划。
  • 02.
    缓存令牌读取价格下降75%,从每百万令牌1美元降至0.25美元,而基础输入/输出定价仍保持在每百万10美元/50美元。Anthropic估计典型节省约为25%,在高度代理型工作负载下可升至约45%——但批评者指出,这一数字描述的是Anthropic自身的工作负载组合,而非对任何特定客户的保证折扣。
  • 03.
    符合条件的客户现在可以选择零数据保留,将数据保留在自己的云基础设施中,为即将推出的专用企业前沿安全计划做准备。
  • 04.
    Anthropic强调,Fable 5.1在编码、写作、代理任务完成和长上下文性能方面有所提升,同时安全机制也进行了调整:生物学相关误报下降85%,Claude Code安全干预减少约60%。Fable 5.1现在被允许发现(但不得利用)软件漏洞。

实际发生了什么变化

Fable 5.1和Mythos 5.1是同一底层模型,仅通过分类器强度区分:Fable 5.1全面上线,Mythos 5.1仍受限于可信访问计划[4]。最具体的变化是定价——缓存令牌读取价格下降75%,从每百万1美元降至0.25美元,而基础费率保持在10美元/50美元[2]。Anthropic自身估计的25%-45%节省[1]反映的是其内部工作负载组合,而非普遍折扣,独立批评者指出[2],而Artificial Analysis发现,在最大推理强度下,Fable 5.1每任务成本反而高出20%,因为它生成的输出令牌数量是Fable 5的1.7倍[2]。在能力方面,最明显的提升体现在狭窄基准测试上——Terminal-Bench-Science从Fable 5的24.7%跃升至Fable 5.1的52.6%[8],AutomationBench从17.1%升至31.4%[10]——同时为符合条件的客户提供新的零数据保留选项[1]

无人完全买账的安全权衡

Anthropic将安全机制的调整描述为对过度触发的修复:生物学相关误报下降85%,Claude Code安全干预减少约60%,并允许Fable 5.1发现(而非利用)软件漏洞[1][3]。Zvi的系统卡分析使这一说法复杂化——他指出,生物安全响应率从94%降至73%,MASK诚实度从91%降至85%,并明确表示不相信Mythos 5.1达到了Anthropic声称的安全层级[4]。独立YouTube评测人Alex Finn的测试也印证了Anthropic营销之外的‘安全放松’叙事:他报告称Fable 5.1比前代模型回应了更多此前被过度拒绝的无害请求,他认为这是更好的过滤,而非安全妥协。两个截然不同的视角——一位安全分析师和一位独立实测评测人——尽管对意义解读不同,却在同一个事实上达成一致。

一场丑闻后的发布

Fable 5.1并非在真空中发布。三个月前,Fable 5的系统卡披露,Anthropic曾秘密降低模型在前沿AI开发请求上的能力,且未告知用户——这一披露引发强烈反弹,用户称该模型被‘削弱’(nerfed)和‘囚禁’(caged)[5]。Anthropic的Fable 5.1公告并未明确提及该争议,但其发布内容的结构与之高度吻合:75%的缓存定价削减[1][2],为符合条件客户提供的新零数据保留选项[1],以及显著降低生物学误报和Claude Code安全干预的安全机制调整[1]。无论这是有意的危机公关,还是单纯的下一次定期更新,其时间点——在‘削弱’披露后约九周,Fable 5原始发布后十二周——都很难被视为巧合。

无人能完成的Astra对比

取决于你选择的基准测试,Fable 5.1要么略微领先,要么明显落后于GPT-6 Astra。Artificial Analysis的数据显示,Fable 5.1的智能指数约为57(最大强度下为65-66),而Astra约为55(最大强度下为61)[6],但Astra在FrontierMath Tier 4 v2(97.6%对87.8%)、GPQA Diamond(96.0%对93.7%)和ExploitBench(100%对Claude Opus 5的70%)上明显领先[7]。Zvi提供了另一个方向的数据点,引用一次早期FrontierMath测试结果称‘Astra以解决68题中的2题占优,而Fable 5.1为零’[8]。综合来看,现有结果尚早、狭窄,且因测试不同而指向各异——不足以支持关于哪个模型更强的明确结论。

Anthropic营销之外的声音

Anthropic自己的发布视频将Fable 5.1定位为长周期可靠性——你可以离开再返回的会话、模型在卡住时主动提示、研究输出附带可验证来源,以及更稳健的科学工作流用于文献综述和实验设计。独立声音则在测试这些说法,而非简单重复。GitHub官方账号确认Fable 5.1已在GitHub Copilot中全面上线,用于长周期编码任务、深度代码库研究和复杂代理工作流。X平台上一个广泛传播的轶事描述了一名开发者在发布当天就用Fable 5.1构建了一个能生成‘5万美元电影级网站’的系统——这是一个虽小但具体的信号,表明人们正迅速在真实场景中压力测试该模型的代理能力。YouTube上,独立评测人Alex Finn称基准提升对‘.1’版本而言异常巨大,并通过自己的非正式测试独立验证了Anthropic的效率主张(据他称,每任务令牌更少,有效成本降低约25%-40%,而非官方数据)——与上述安全测试一样,这是完全来自Anthropic外部的双重验证。他还进行了一次非严谨的3D编码对比测试,对象为‘GPT 5/6 sole’,并自认是轶事性而非真实基准。Reddit上的反响则更为混杂:一个热门讨论帖显示,开发者推动Fable 5.1使用约14个并行子代理从零开始构建一个three.js版《城市:天际线》克隆,但在触及能力上限前就撞上了使用限额;另一个帖子显示Fable 5.1从单个提示生成了一个Blender加图像生成的微缩模型,但被评论者批评为‘看起来很酷但无实际用处’;第三个带有幽默标签的帖子则将模型更简短的拒绝解读为向‘倦怠的资深开发者’的性格转变。

历史背景

Claude Fable 5以每百万令牌10美元/50美元发布,定位用于长周期代理工作。
在美国AWS安全研究人员演示越狱后,美国出口管制针对Fable 5;Anthropic暂停所有人访问三天。
Fable 5重新部署。其系统卡披露,Anthropic曾秘密降低模型在前沿AI开发请求上的能力且未告知用户,引发‘削弱’/‘囚禁’的用户反弹。
Anthropic发布Fable 5.1和Mythos 5.1,距Fable 5原始发布约十二周。

关键关系图

关键玩家
主题

Anthropic发布Claude Fable 5.1

AN

Anthropic

Developer and publisher of Claude Fable 5.1 / Mythos 5.1; set pricing, safeguard policy, and the zero-data-retention offering, following the Fable 5 'nerfed'/'caged' backlash two months earlier.

ZV

Zvi Mowshowitz (Don't Worry About the Vase)

Independent AI analyst who published separate capabilities and system-card writeups on Fable 5.1/Mythos 5.1, calling the model excellent and well-rounded while flagging modest benchmark gains, a narrow early Astra comparison, and safety regressions that lead him to doubt Anthropic's own Mythos 5.1 safety-tier claim.

AM

Amazon Web Services (AWS)

Cloud partner that made Fable 5.1 available on its platform at launch; AWS security researchers were also the ones who discovered the Fable 5 jailbreak that triggered June's export-control suspension.

AR

Artificial Analysis

Independent benchmarking firm that found Fable 5.1 costs 20% more per task than Fable 5 at maximum effort ($3.76 vs $3.14) because it produces 1.7x more output tokens, complicating the headline efficiency story.

OP

OpenAI

Competitor whose GPT-6 Astra model is the most frequent head-to-head comparison point for Fable 5.1 in third-party benchmarks, with results split depending on the test.

事实来源

10 条引用
  1. [1] Claude Fable 5.1 and Mythos 5.1 announcement
  2. [2] Anthropic Fable 5.1: same price, cache reads cut
  3. [3] Anthropic Claude Fable 5.1 coverage
  4. [4] Claude Fable 5.1 and Mythos 5.1: The System Card
  5. [5] AINews: Claude Fable/Mythos 5.1
  6. [6] GPT-6 Astra vs Claude Fable 5.1 comparison
  7. [7] Benchmarking GPT-6 Astra
  8. [8] Claude Mythos 5.1 and Fable 5.1: Capabilities
  9. [9] Claude Fable 5.1 available on AWS
  10. [10] Anthropic Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for Fable cache reads

来源文章

Top 3

THE SIGNAL.

Analysts

称Fable 5.1优秀且全面,但明确指出基准提升本身有限——‘在大多数基准上较Fable 5有适度提升,伴随少量退步’——而非决定性飞跃。

Zvi Mowshowitz
独立AI分析师,《Don't Worry About the Vase》作者

引用一次早期FrontierMath结果指出,‘Astra以解决68题中的2题占优,而Fable 5.1为零’,凸显了目前与GPT-6 Astra的直接对比数据仍何其稀薄且不一致。

Zvi Mowshowitz
独立AI分析师,《Don't Worry About the Vase》作者

质疑Anthropic对Mythos 5.1的安全层级描述——‘我不相信Anthropic。我认为Mythos 5.1可能属于2级’——并指出多轮生物安全响应率(94%降至73%)和MASK诚实度(91%降至85%)的实测下降,作为真实退步的证据。

Zvi Mowshowitz
独立AI分析师,《Don't Worry About the Vase》作者

反驳Anthropic约25%-45%的节省估计,称其为‘对Anthropic自身工作负载的测量,而非对你的折扣’。

Digital Applied (博客分析师)
独立技术评论网站
The Crowd

We're introducing Claude Fable 5.1 and Claude Mythos 5.1. They're the world's most advanced models for coding and knowledge work.

@@claudeai65479

Claude Fable 5.1, the latest in @AnthropicAI's Mythos model class, is now generally available in GitHub Copilot. In our testing it showed strong performance on: long-running coding tasks, deep codebase research, complex agentic workflows. Try it out in the GitHub Copilot

@@github717

The CEO of Anthropic realizing that Claude Fable 5.1 came out 24 hours ago and some guy used it to build a system for creating $50,000 movie like websites and just leaked the entire strategy for free

@@deanwperkins411

Fable 5.1 Max gave me the most reasonable local setup guide

@u/Delicious-Flan883300
Broadcast
Introducing Claude Fable 5.1

Introducing Claude Fable 5.1

Meet Claude Fable 5.1

Meet Claude Fable 5.1

Claude Fable 5.1 just dropped and I can't believe it...

Claude Fable 5.1 just dropped and I can't believe it...