Anthropic 在 2026 年 9 月 1 日发布 Claude Fable 5.1。真正的看点不是降价,而是计费结构的挪动:输入和输出与 Claude Fable 5 同价,省钱的地方在缓存提示读取。

被忽略的那一半更有用:Anthropic 建议大多数团队继续留在 Claude Opus 5。

Claude Fable 5.1 是什么

它接替的是 Claude Fable 5——2026 年 6 月 9 日发布,三天后暂停,7 月 1 日恢复。

同一个模型挂两块牌子。Claude Mythos 5.1 的能力和价格完全一致,差别在安全防护:Fable 5.1 面向所有用户开放,Mythos 5.1 只给 Anthropic 受信访问计划里通过审核的机构,用于网络安全和生命科学。

Anthropic 称它是目前能力最强的公开可用模型,为「目标宏大、运行时间长、异步推进的工作」而打造。输出带该公司的统计水印;Anthropic 表示水印不增加 token、不写入隐藏字符,也不包含任何关于你的信息。

已公布的规格

项目官方数值
上下文窗口1M tokens
最大输出128K tokens
思考自适应,始终开启
默认 efforthigh
相对延迟更慢
输入与输出文本和图像 → 文本
知识截止2026 年 6 月
发布日期2026 年 9 月 1 日
退役时间不早于 2027 年 9 月 1 日

自适应思考是这里唯一的思考模式,也不用手动开启;深度靠 effort 控制。五个平台提供它:Claude API、Google Cloud、Microsoft Foundry 和 Claude Platform on AWS 用 claude-fable-5-1,Amazon Bedrock 用 anthropic.claude-fable-5-1

相较 Claude Fable 5 的变化

计费项价格
输入$10 / MTok
输出$50 / MTok
5 分钟缓存写入$12.50 / MTok
1 小时缓存写入$20 / MTok
缓存读取$0.25 / MTok
批处理 API减免 50%

缓存读取才是值得搞清楚的那处变化。它现在的价格是基础输入价的 0.025 倍,而产品线其余模型是 0.1 倍,「便宜 75%」就是这么来的。Anthropic 用 2026 年 8 月四周的真实用量、按默认 effort 测算:典型工作成本降低约 25%,在缓存读取占账单大头的 agentic 工作里最高约 45%。

两个前提。数据必须留在美国境内的负载按标价 1.1 倍计费。保留策略也没放松:两个模型都是 30 天数据保留,除非 Anthropic 明确授权,否则不适用于零数据保留。Enterprise Frontier Safeguards 把数据留在客户自控的基础设施内,从今年秋季晚些时候开始分阶段推出。

Anthropic 尚未公布的内容

任何方案都没有固定的消息条数上限,用量额度与 token 之间的换算比例也没有任何地方公布。继任者没公布;2027 年 9 月 1 日这个退役下限之后会怎样,同样没公布。

在模型阵容中的位置

模型上下文最大输出价格 / MTok延迟默认 effort
Claude Fable 5.11M128K$10 / $50更慢high
Claude Opus 51M128K$5 / $25中等high
Claude Sonnet 51M128K$2 / $10high
Claude Haiku 4.5200K64K$1 / $5最快不支持

在消费者方案里 Fable 这一行并不宽裕:Free 不可用,Pro 要走用量额度,Max 只给每周上限的一半。

为什么 Anthropic 指向 Opus 5

模型页写得很直白:大多数负载从 Claude Opus 5 起步,只有当任务需要高难度推理和长时间跨度的 agentic 工作,或你把 Opus 5 调到更高 effort 后评测仍不达标,才去用 Fable 5.1。

价差解释了这条建议,因为 Opus 5 每 token 只花一半的钱。Fable 5.1 的价值出现在任务要跑好几个小时、反复重读同一段大上下文的时候,缓存读取的改动正是为这种场景准备的。方案细节见价格与方案对比

两个可以直接照抄的示例

左右两块:左侧是叠放的请求卡片,由一条弯曲箭头相连;右侧是一列短状态条,下方是一块宽色块

两者都不是厂商样例,而是官方文档推荐的输入,这里写成可直接粘贴的形式。

示例一:把现有的 Claude Fable 5 调用搬过来,要改的只有模型 id 和 effort 档位。

{
  "model": "claude-fable-5-1",
  "max_tokens": 16000,
  "output_config": { "effort": "high" },
  "messages": [{ "role": "user", "content": "Your task here." }]
}

effort 决定这笔账怎么算,所以别猜,直接扫一遍。该模型支持 lowmediumhighxhighmax,默认是 high。Anthropic 的说法是,在 lowmedium 下它已追平甚至超过 Fable 5,花费却低得多;同时 effort 名称在不同代之间不代表相同的思考量。用 high 及以上时要把 max_tokens 设大,因为它同时限制思考和回复。

示例二:长时间 agent 回合中途变得安静。这个模型在工具调用之间写给用户的更新比 Fable 5 少,官方解法是一行系统提示。

Before you start, say in a line what you're about to do; brief updates while you work help the user follow along. Close with a short recap that stands on its own — what you found, what you did, and what's next — so a reader who only sees the last message has the full picture.

这一行同时管住两端,因为这些简短说明以 thinking 块的形式到达,而在默认的 thinking.displayomitted 时会返回空内容。

从 Claude Fable 5 迁移

换 id 最简单。Anthropic 标出了三处破坏性变更,它们都指向同一个决定:thinking 块现在与产生它的模型和那段对话绑定在一起。

三处破坏性变更

强制工具调用会报错。类型为 anytooltool_choice 都必须去掉,模式约束改用 auto 的严格工具调用,或改用结构化输出。

更早的模型读不了这些 thinking 块,所以把一段对话搬到 5.1 之前的模型上,它们不会被加载。

编辑前面的某一回合会让其后所有块失效,只要框架在两次请求之间重写历史就会触发。替代方案是回合作用域系统消息,它在一回合内拥有系统级权限,然后失效:

{
  "role": "system",
  "clear_at": "next_user_message",
  "content": "Results have landed in your inbox. Check it before running more code."
}

agent 循环还有一个怪脾气。Fable 5 会把几个互不依赖的工具调用合并进一个回合,5.1 可能让每个各占一个回合,每次都多一次往返。官方提示放在请求末尾:

First privately list what you need next; then request every item that doesn't depend on another's result in this one response.

Anthropic 仍建议无论如何都重跑评测,因为 effort 档位在不同代之间不能干净对应。如果你从零开始,API 接入指南里有认证部分。

常见问题

Fable 5.1 是新模型还是改名? 是新模型,2026 年 9 月 1 日发布。Anthropic 说它在编程、知识工作和长时间问题求解任务上确立了新标准。

那为什么建议改用 Opus 5? 大多数负载它已经够用,而且每百万 token 是 $5 / $25,对比 $10 / $50。

价格真的降了吗? 标价没降。输入和输出不变;缓存读取降了 75%,到每百万 token $0.25,Anthropic 估计这让典型负载便宜约 25%。

Fable 5.1 还是 Mythos 5.1? 差别在安全防护,不在能力。同一个模型、同一套价格,Mythos 只限受信访问计划。

能在零数据保留下跑它吗? 默认不行。两个模型都是 30 天数据保留,否则需要明确授权。

接下来该看哪里? Claude Code 终端指南讲的就是这个模型调优所面向的 agent 工作流;如果还没选定模型家族,横向对比系列能帮上忙。

先从 Opus 5 起步,盯住缓存读取在你账单里的占比,让自家评测决定什么时候 Fable 5.1 值这个更贵的 token 价。