Fable 5.1 降价之后:三笔账算下来,每个任务反而贵了 20%
Anthropic 给 Fable 5.1 砍了 75% 缓存读取价,基础价一分没动。把价格表、复用曲线和第三方实测三笔账摊开算,再对照国产旗舰的价差看一遍,结论和「降价」两个字不太一样。
Claude Fable 5.1 是 2026 年 9 月 1 日发的,通稿的落点是省钱。把价格表摊开会发现,基础价一分没动——输入还是每百万 token $10,输出还是 $50,和 Fable 5 一模一样。变的只有一行:缓存读取从 $1 降到 $0.25。 这一刀确实砍掉了 75%,但它能落到你账单上多少,完全取决于你的输入里有多大比例是从缓存读出来的。
下面把三笔账摊开算。结论是:这次降价是真的,每个任务反而更贵也是真的,两件事并不矛盾。
第一笔账:降的是哪一行
Anthropic 每个模型公布五个价格,通稿一般只引其中一个。完整的表(美元每百万 token):
| 模型 | 基础输入 | 5 分钟缓存写 | 1 小时缓存写 | 缓存读 | 输出 |
|---|---|---|---|---|---|
| Fable 5.1 | 10 | 12.50 | 20 | 0.25 | 50 |
| Fable 5 | 10 | 12.50 | 20 | 1.00 | 50 |
| Opus 5 | 5 | 6.25 | 10 | 0.50 | 25 |
| Sonnet 5 | 2 | 2.50 | 4 | 0.20 | 10 |
两行 Fable 并排看,五个数里有四个一模一样。它不是变便宜了,只是在同一个价位上换了一套更便宜的缓存。
第二笔账:复用多少次才见效
缓存的省钱效果随复用次数放大。拿一段 100 万 token 的前缀——一个代码库、一批文档、一段很长的系统提示词——写进缓存一次,然后读 N 次:
| 读取次数 | Fable 5 | Fable 5.1 | 不用缓存 |
|---|---|---|---|
| 1 | $13.50 | $12.75 | $20.00 |
| 10 | $22.50 | $15.00 | $110.00 |
| 100 | $112.50 | $37.50 | $1,010.00 |
| 500 | $512.50 | $137.50 | $5,010.00 |
(假设只写一次缓存、中间不过期。读取会免费续期,所以持续活跃的 agent 符合这个假设;前缀过期要重写的话,Fable 两列的数字各加 $12.50。「不用缓存」列是同样 N+1 次完整输入按 $10 计。)
读 1 次的时候两个版本差不到 6%,读 100 次时 5.1 只要 Fable 5 的三分之一。这中间模型本身没有任何变化,变的只是同一段上下文你复用了多少次。
官方那两个数字(约 25% 和最多约 45%)差这么远就是这个原因。一次会话里碰几次缓存的负载落在 25% 附近;一个下午反复读同一个仓库几百次的长跑 agent 才够得着 45% 那一端。想知道自己是哪一档,去数缓存命中次数,别数请求数。
第三笔账:第三方实测,每个任务反而贵 20%
这一笔是前两笔算不出来的。
Artificial Analysis 参与了 Fable 5.1 的发布前评测,公布的每任务成本是这样:
| 模型(max effort) | 智能指数 | 每任务成本 |
|---|---|---|
| Fable 5.1 | 66 | $3.76 |
| Opus 5 | 63 | $2.34 |
| Fable 5 | 62 | $3.14 |
他们自己的标题写得很直白:Fable 5.1「登顶 Artificial Analysis 智能指数,但尽管缓存读取降价 75%,每个任务的成本仍比 Fable 5 高 20%」。
原因落在前两笔账都没碰到的那一半:输出。5.1 在 max effort 下要多吐大约 1.7 倍的输出 token。 输出是 $50 那一行,缓存降价一分钱都够不着它。
所以这笔账该这么读:它既更贵,也更强——66 分是他们测过的最高分。买的是指数顶端,代价是每个任务比以前更花钱,不是更省钱。
换个尺度:和国产旗舰的价差
上面三笔都是 Claude 家族内部的账。国内团队真正要面对的是另一个数量级的问题。下面把 Fable 5.1 的 Anthropic 官方定价,和 Ofox 目录里几个国产旗舰的实际计费价放在一起看。注意第一行是官方定价,Fable 5.1 并不在 Ofox 目录里:
| 模型 | 输入 | 输出 | 相对 Fable 5.1 输出价 |
|---|---|---|---|
| Fable 5.1(Anthropic 官方定价,未上架 Ofox) | 10 | 50 | 1 |
| Opus 5 | 5 | 25 | 1/2 |
| Kimi K3 | 3 | 15 | 1/3.3 |
| Qwen3.8 Max | 2 | 6 | 1/8.3 |
| GLM-5.3 | 1.26 | 3.96 | 1/12.6 |
| MiniMax M3 | 0.6 | 2.4 | 1/20.8 |
(GLM-5.3 的 $1.26/$3.96 是目录里的实际计费价,标价是 $1.40/$4.40。)
在这个尺度上,缓存读取从 $1 降到 $0.25 几乎看不出来。如果你现在跑在 GLM 或 MiniMax 上,要不要上 Fable 5.1 是个能力问题,不是价格问题——省下来的那点缓存费用,改变不了输出价差 12.6 到 20.8 倍的事实。
反过来说,如果一个任务只有 Fable 级别才做得下来,那这十几二十倍的价差本来就不在讨论范围里。
有个坑,比降价本身更贵
还按上面那段 100 万 token 的前缀算。Anthropic 卖两种缓存写入时长:5 分钟每百万 token $12.50,1 小时 $20。
5 分钟这个时限没听上去那么紧。官方文档明确写着缓存「每次被使用时都会免费续期」,生命周期从每次写入或读取的请求开始计算。所以一个持续命中同一段前缀的 agent,靠读取就能把 5 分钟的条目一直续着,只付一次写入。
钱漏在空档里。一次规划、一轮慢工具调用、一个人在看 diff——任何超过五分钟的安静时段都会让条目过期,下一次调用重新付写入费。这样跑一小时,最坏要写 12 次,12 × $12.50 = $150,而 1 小时档写一次是 $20。
这 $130 的差额,相当于 173 次缓存读取省下来的钱(每读一次省 $0.75),而且它由你的流量长什么样决定,跟你选哪个模型没关系。持续繁忙的 agent 可能永远碰不到最坏情况,会闲置的一定会碰到。在把新价格算进预算之前,先搞清楚自己跑的是哪一种。
规格上一个容易被忽略的差别
| Fable 5.1 | Opus 5 | Sonnet 5 | |
|---|---|---|---|
| 思考模式 | Adaptive(常开) | Adaptive | Adaptive |
| 默认 effort | high | high | high |
| 上下文 | 1M | 1M | 1M |
| 最大输出 | 128K | 128K | 128K |
| 可靠知识截止 | 2026-06 | 2026-05 | 2026-01 |
模型 ID 是 claude-fable-5-1。上下文和输出上限三者完全一样,真正的区别在价格、行为,以及最后那一行——Fable 5.1 的知识截止是这三个里最新的,比 Opus 5 新一个月,比 Sonnet 5 新五个月。碰到近期的库版本和 API 变更,这一个月是实打实的差距。
Mythos 5.1 在同一张价格表里,费率完全相同。Anthropic 说它和 Fable 5.1「是同一个底层模型」,差别「反映的是我们早期那套不够精确的网络安全护栏曾经介入过的那些任务」。访问要走两个验证计划,两条线进度不一样:生命科学验证计划已经开了邀请制 beta,受邀方现在就能用;网络安全验证计划则是「将在近期纳入 Mythos 模型访问」。目前只面向一批美国机构开放,不是拿把 API Key 就能调的。
顺带更正一个传得很广的说法:不少地方把误报变少当成 5.1 的新特性。那其实是 2026 年 8 月 7 日针对 Fable 5 生物学护栏的一次独立更新,Anthropic 称该更新「在我们的各产品界面上,让生物学相关的降级回退减少了约 85%」,和这次发布没有关系。
怎么选
| 你现在的情况 | 建议 |
|---|---|
| 已经在 Fable 5 上 | 可以换,但别当成降价。基础价一样、缓存更便宜、知识截止更靠后;代价是同档 effort 下输出 token 多约 1.7 倍,实测每任务贵 20% |
| 在 Opus 5 上,成本敏感 | 别换。任何现实配比下 Opus 5 都更便宜,实测每任务差 1.6 倍 |
| 在 Opus 5 上,卡在能力上限 | 值得试。5.1 的智能指数确实更高(66 对 63),但预算要按每任务贵约 60% 算($2.34 → $3.76);官方那个「省 25%」说的是缓存读取,和这笔账没关系 |
| 在 GLM / Kimi / MiniMax 上 | 这是能力决策。输出价差从 3.3 倍(Kimi K3)到 20.8 倍(MiniMax M3),缓存那点降幅改变不了什么 |
然后去检查你的缓存 TTL。对一个会闲置的长跑 agent,那一个设置牵动的金额,比本文讨论的这次降价还大。
现在能不能调
截至 2026 年 9 月 2 日,Ofox 目录里是 anthropic/claude-fable-5、anthropic/claude-opus-5 和 anthropic/claude-sonnet-5,按 Anthropic 官方定价计费、不加价。Fable 5.1 还没有进目录。
想照本文的口径拿真实流量验证,Fable 5 和 Opus 5 都能用同一把 Ofox Key 调,两种协议都能走:OpenAI 兼容的 https://api.ofox.ai/v1,或 Anthropic 原生的 https://api.ofox.ai/anthropic。
价格与规格于 2026 年 9 月 2 日核对自 Anthropic 定价文档、模型总览、产品页、发布公告、prompt caching 文档、Mythos 产品页与 2026 年 8 月 7 日的生物学护栏更新公告;每任务成本数据来自 Artificial Analysis,同日取得;国产模型计费价取自 Ofox 目录同日快照。
常见问题
- Claude Fable 5.1 到底降价了没有?
- 降了一行。基础输入仍是每百万 token $10,输出仍是 $50,和 Fable 5 完全一样;变的是缓存读取,从 $1 降到 $0.25。Anthropic 自己的说法是这一项降了 75%,「把典型负载的成本压下来约 25%,重度 agent 场景最多约 45%」。所以省多少完全取决于你的输入里有多大比例是从缓存里读出来的——很少命中缓存的话,账单基本不动。
- 为什么第三方实测说它反而更贵?
- Artificial Analysis 在 max effort 档实测,Fable 5.1 每个 Intelligence Index 任务花 $3.76,比 Fable 5 的 $3.14 贵 20%,是 Opus 5($2.34)的 1.6 倍。原因是它在这个档位下要多吐大约 1.7 倍的输出 token,而输出是 $50 那一行——缓存降价一分钱都够不着输出。同一批测试里它的智能指数是 66,高于 Opus 5 的 63 和 Fable 5 的 62,所以这是「更贵也更强」,不是「又贵又差」。
- 国内团队该换到 Fable 5.1 吗?
- 先看你现在在用什么。如果本来就在 Fable 5 上,换过去能拿到更便宜的缓存和更新的知识截止,但要按每任务贵 20% 重排预算——它多吐的输出 token 走的是 $50 那一行。如果在 Opus 5 上,5.1 在任何现实的输入输出配比下都算不回来。如果在 GLM、Kimi、MiniMax 这类国产旗舰上,输出价差从 3 倍到 20 倍不等,换不换是能力问题,不是价格问题。
- 缓存的 5 分钟和 1 小时该选哪个?
- 看你的 agent 会不会闲置。Anthropic 文档写明缓存「每次被使用时都会免费续期」,生命周期从每次读或写的请求开始算。所以持续繁忙的 agent 用 5 分钟档也只付一次写入费。但只要中间有超过 5 分钟的空档——规划、等工具返回、等人看 diff——条目就过期了,下次调用要重新付写入。一小时内最坏情况下要重写 12 次。
- 现在能在 Ofox 上调 Fable 5.1 吗?
- 还不能。截至 2026 年 9 月 2 日,Ofox 目录里有 Claude Fable 5、Opus 5 和 Sonnet 5,按 Anthropic 官方定价计费,没有 5.1 条目。想照本文的口径拿真实流量验证,Fable 5 和 Opus 5 都能用同一把 Key 调。


