Anthropic 在 2026 年 9 月 1 日发布 Claude Fable 5.1。真正的看点不是降价,而是计费结构的挪动:输入和输出与 Claude Fable 5 同价,省钱的地方在缓存提示读取。
被忽略的那一半更有用:Anthropic 建议大多数团队继续留在 Claude Opus 5。
Claude Fable 5.1 是什么
它接替的是 Claude Fable 5——2026 年 6 月 9 日发布,三天后暂停,7 月 1 日恢复。
同一个模型挂两块牌子。Claude Mythos 5.1 的能力和价格完全一致,差别在安全防护:Fable 5.1 面向所有用户开放,Mythos 5.1 只给 Anthropic 受信访问计划里通过审核的机构,用于网络安全和生命科学。
Anthropic 称它是目前能力最强的公开可用模型,为「目标宏大、运行时间长、异步推进的工作」而打造。输出带该公司的统计水印;Anthropic 表示水印不增加 token、不写入隐藏字符,也不包含任何关于你的信息。
已公布的规格
| 项目 | 官方数值 |
|---|---|
| 上下文窗口 | 1M tokens |
| 最大输出 | 128K tokens |
| 思考 | 自适应,始终开启 |
| 默认 effort | high |
| 相对延迟 | 更慢 |
| 输入与输出 | 文本和图像 → 文本 |
| 知识截止 | 2026 年 6 月 |
| 发布日期 | 2026 年 9 月 1 日 |
| 退役时间 | 不早于 2027 年 9 月 1 日 |
自适应思考是这里唯一的思考模式,也不用手动开启;深度靠 effort 控制。五个平台提供它:Claude API、Google Cloud、Microsoft Foundry 和 Claude Platform on AWS 用 claude-fable-5-1,Amazon Bedrock 用 anthropic.claude-fable-5-1。
相较 Claude Fable 5 的变化
| 计费项 | 价格 |
|---|---|
| 输入 | $10 / MTok |
| 输出 | $50 / MTok |
| 5 分钟缓存写入 | $12.50 / MTok |
| 1 小时缓存写入 | $20 / MTok |
| 缓存读取 | $0.25 / MTok |
| 批处理 API | 减免 50% |
缓存读取才是值得搞清楚的那处变化。它现在的价格是基础输入价的 0.025 倍,而产品线其余模型是 0.1 倍,「便宜 75%」就是这么来的。Anthropic 用 2026 年 8 月四周的真实用量、按默认 effort 测算:典型工作成本降低约 25%,在缓存读取占账单大头的 agentic 工作里最高约 45%。
两个前提。数据必须留在美国境内的负载按标价 1.1 倍计费。保留策略也没放松:两个模型都是 30 天数据保留,除非 Anthropic 明确授权,否则不适用于零数据保留。Enterprise Frontier Safeguards 把数据留在客户自控的基础设施内,从今年秋季晚些时候开始分阶段推出。
Anthropic 尚未公布的内容
任何方案都没有固定的消息条数上限,用量额度与 token 之间的换算比例也没有任何地方公布。继任者没公布;2027 年 9 月 1 日这个退役下限之后会怎样,同样没公布。
在模型阵容中的位置
| 模型 | 上下文 | 最大输出 | 价格 / MTok | 延迟 | 默认 effort |
|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | 更慢 | high |
| Claude Opus 5 | 1M | 128K | $5 / $25 | 中等 | high |
| Claude Sonnet 5 | 1M | 128K | $2 / $10 | 快 | high |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | 最快 | 不支持 |
在消费者方案里 Fable 这一行并不宽裕:Free 不可用,Pro 要走用量额度,Max 只给每周上限的一半。
为什么 Anthropic 指向 Opus 5
模型页写得很直白:大多数负载从 Claude Opus 5 起步,只有当任务需要高难度推理和长时间跨度的 agentic 工作,或你把 Opus 5 调到更高 effort 后评测仍不达标,才去用 Fable 5.1。
价差解释了这条建议,因为 Opus 5 每 token 只花一半的钱。Fable 5.1 的价值出现在任务要跑好几个小时、反复重读同一段大上下文的时候,缓存读取的改动正是为这种场景准备的。方案细节见价格与方案对比。
两个可以直接照抄的示例

两者都不是厂商样例,而是官方文档推荐的输入,这里写成可直接粘贴的形式。
示例一:把现有的 Claude Fable 5 调用搬过来,要改的只有模型 id 和 effort 档位。
{
"model": "claude-fable-5-1",
"max_tokens": 16000,
"output_config": { "effort": "high" },
"messages": [{ "role": "user", "content": "Your task here." }]
}
effort 决定这笔账怎么算,所以别猜,直接扫一遍。该模型支持 low、medium、high、xhigh 和 max,默认是 high。Anthropic 的说法是,在 low 或 medium 下它已追平甚至超过 Fable 5,花费却低得多;同时 effort 名称在不同代之间不代表相同的思考量。用 high 及以上时要把 max_tokens 设大,因为它同时限制思考和回复。
示例二:长时间 agent 回合中途变得安静。这个模型在工具调用之间写给用户的更新比 Fable 5 少,官方解法是一行系统提示。
Before you start, say in a line what you're about to do; brief updates while you work help the user follow along. Close with a short recap that stands on its own — what you found, what you did, and what's next — so a reader who only sees the last message has the full picture.
这一行同时管住两端,因为这些简短说明以 thinking 块的形式到达,而在默认的 thinking.display 为 omitted 时会返回空内容。
从 Claude Fable 5 迁移
换 id 最简单。Anthropic 标出了三处破坏性变更,它们都指向同一个决定:thinking 块现在与产生它的模型和那段对话绑定在一起。
三处破坏性变更
强制工具调用会报错。类型为 any 或 tool 的 tool_choice 都必须去掉,模式约束改用 auto 的严格工具调用,或改用结构化输出。
更早的模型读不了这些 thinking 块,所以把一段对话搬到 5.1 之前的模型上,它们不会被加载。
编辑前面的某一回合会让其后所有块失效,只要框架在两次请求之间重写历史就会触发。替代方案是回合作用域系统消息,它在一回合内拥有系统级权限,然后失效:
{
"role": "system",
"clear_at": "next_user_message",
"content": "Results have landed in your inbox. Check it before running more code."
}
agent 循环还有一个怪脾气。Fable 5 会把几个互不依赖的工具调用合并进一个回合,5.1 可能让每个各占一个回合,每次都多一次往返。官方提示放在请求末尾:
First privately list what you need next; then request every item that doesn't depend on another's result in this one response.
Anthropic 仍建议无论如何都重跑评测,因为 effort 档位在不同代之间不能干净对应。如果你从零开始,API 接入指南里有认证部分。
常见问题
Fable 5.1 是新模型还是改名? 是新模型,2026 年 9 月 1 日发布。Anthropic 说它在编程、知识工作和长时间问题求解任务上确立了新标准。
那为什么建议改用 Opus 5? 大多数负载它已经够用,而且每百万 token 是 $5 / $25,对比 $10 / $50。
价格真的降了吗? 标价没降。输入和输出不变;缓存读取降了 75%,到每百万 token $0.25,Anthropic 估计这让典型负载便宜约 25%。
Fable 5.1 还是 Mythos 5.1? 差别在安全防护,不在能力。同一个模型、同一套价格,Mythos 只限受信访问计划。
能在零数据保留下跑它吗? 默认不行。两个模型都是 30 天数据保留,否则需要明确授权。
接下来该看哪里? Claude Code 终端指南讲的就是这个模型调优所面向的 agent 工作流;如果还没选定模型家族,横向对比系列能帮上忙。
先从 Opus 5 起步,盯住缓存读取在你账单里的占比,让自家评测决定什么时候 Fable 5.1 值这个更贵的 token 价。