Fable 5.1 vs Fable 5 vs Opus 5:降的只有缓存那一行

Claude Fable 5.1 沿用 Fable 5 的 $10/$50 基础价,唯一降的是缓存读取,$1 降到 $0.25。这 25% 什么时候能落到账上,以及为什么算总账 Opus 5 还是更划算。

Fable 5.1 vs Fable 5 vs Opus 5:降的只有缓存那一行

Claude Fable 5.1 于 2026 年 9 月 1 日发布,通稿的落点是省钱。动手之前先把价格表摊开看看再说。基础价一分没动——输入还是每百万 token $10,输出还是 $50,和 Fable 5 完全一样。整个降幅只落在一行上:缓存读取从 $1 降到 $0.25。 这一刀确实砍掉了 75%,Anthropic 说的「典型负载约 25%,重度 agent 场景最多约 45%」,算的就是这一行。但它能落到你账单上多少,完全取决于你的输入里有多大比例真的走了缓存。

没人细看的那张价格表

Anthropic 每个模型公布五个费率,多数报道只引其中一个。下面是完整的,单位是美元每百万 token:

模型基础输入5 分钟缓存写1 小时缓存写缓存读输出
Fable 5.11012.50200.2550
Fable 51012.50201.0050
Opus 556.25100.5025
Sonnet 522.5040.2010

把两行 Fable 并排看:五个数里有四个一模一样。Fable 5.1 不是更便宜的模型,它是同一个价位上的同一个模型,换了一套更便宜的缓存。

这对你的账单意味着什么

缓存省下来的钱随复用次数放大,所以同一个费率变化落到不同负载上差别极大。拿一段 100 万 token 的前缀——一个代码库、一批文档、一段很长的 system prompt——写入缓存一次,然后读回 N 次。「不用缓存」一列是同样 N+1 次完整输入按每百万 token $10 计的花费:

读取次数Fable 5Fable 5.1不用缓存5.1 优势
1$13.50$12.75$20.001.06 倍
10$22.50$15.00$110.001.50 倍
100$112.50$37.50$1,010.003.00 倍
500$512.50$137.50$5,010.003.73 倍

假设只写一次 5 分钟缓存,期间不过期——读取会免费续期,所以持续活跃的 agent 符合这个假设。前缀凉掉、需要重写的话,每重写一次,Fable 两列就各加 $12.50,见下面的 TTL 一节。

读 1 次时两个版本差距在 6% 以内;读 100 次时 Fable 5.1 只要 Fable 5 的三分之一。这几行之间模型本身没有任何变化,变的只是同一段缓存上下文你回头用了多少次。

Anthropic 那两个数字之所以差这么远,原因就在这里。每个会话只碰几次缓存上下文的负载,落在 25% 附近;一个 agent 整下午反复读同一个代码库几百次,那才够得着「最多约 45%」那一端。想知道自己属于哪一种,去数缓存命中次数,别数请求数。

举个具体例子:100 万输入 token,其中 90% 是缓存读取,外加 2 万输出。

  • Fable 5:$0.90 缓存 + $1.00 新输入 + $1.00 输出 = $2.90
  • Fable 5.1:$0.225 缓存 + $1.00 新输入 + $1.00 输出 = $2.225

省了 23%,和 Anthropic 给典型用法估的 25% 对得上。注意这笔省钱是从哪来的:缓存那一行降了四分之三,但它本来也只占账单的三成左右。

TTL 怎么选,比这次降价影响更大

Anthropic 卖两种缓存写入时长,这是多数成本模型漏掉的一块。5 分钟缓存写入是每百万 token $12.50,1 小时是 $20。

5 分钟这个时限没听上去那么紧。Anthropic 文档写得很明确:「缓存每次被使用时都会免费续期。」只要有请求写入或读取了这个条目,生命周期就从那一刻重新开始算。一个持续命中同一段前缀的 agent,光靠读取就能把 5 分钟的条目一直续着,只付一次写入费。

钱是漏在空档里的。一次规划、一轮慢工具调用、一个人在看 diff——任何超过五分钟的安静时段都会让条目过期,下一次调用重新付写入费。这样跑一小时,最坏情况是 12 × $12.50 = $150,而 1 小时档写一次是 $20

这个最坏情况下每段前缀每小时差 $130,比 Fable 5.1 这次缓存降价能省下的还多——而且它由你的流量长什么样决定,跟你选哪个模型无关。持续繁忙的 agent 可能永远碰不到,会闲置的一定会碰到。在把新价格算进预算之前,先搞清楚自己跑的是哪一种。

Fable 5.1 vs Opus 5:数字里的陷阱

确实有一行反过来了:Fable 5.1 读缓存 $0.25,是 Opus 5($0.50)的一半——尽管它的基础输入是 Opus 5 的两倍,输出也是两倍。

于是很容易想到:缓存密集的 agent 是不是该往 Fable 上升一档了。列个式子算一下就知道不是。设输入为 I、缓存读取占比为 f、输出为 O,Fable 5.1 更便宜的条件是:

10(1−f)·I + 0.25f·I + 50·O  <  5(1−f)·I + 0.50f·I + 25·O
→  5I − 5.25f·I + 25O < 0
→  f > (5 + 25·(O/I)) / 5.25

把输出设成零(等于说这个负载什么都不生成),f 仍然要大于 95.2%。你每多生成一个 token,这个阈值就更高。现实里没有哪种配比能让 Fable 5.1 在总成本上压过 Opus 5。

拿上面那个例子一算就清楚:同样的流量,Fable 5.1 花 $2.225,Opus 5 花 $1.45。一行更便宜,撑不起其他各项都是两倍的模型。

所以决策本身没变,只是其中一个维度变便宜了:该选 Fable 5.1 的理由是你需要它的能力,不是拿它去比 Opus 5 更省钱。 新的缓存定价买到的是这么一件事:长时间跑 agent 时,留在 Mythos 级模型上要多付的那笔溢价,比 Fable 5 时代小了一些。

一份独立实测指向同一个结论

Artificial Analysis 参与了这次的发布前评测,他们公布的每任务成本正好印证了这一点。标题原话是:Fable 5.1「登顶 Artificial Analysis 智能指数,但尽管缓存读取降价 75%,每个任务的成本仍比 Fable 5 高 20%」。

模型(max effort)智能指数每任务成本
Fable 5.166$3.76
Opus 563$2.34
Fable 562$3.14

原因就在前面一直没正面碰的另一半账上:输出。Fable 5.1 在 max effort 下要多吐大约 1.7 倍的输出 token。输出走的是 $50 那一行,$0.25 那一行降多少都够不着它。更便宜的缓存没有让它变成更便宜的模型——在同一套任务上端到端量出来,它比自己的前代贵了 20%,是 Opus 5 的 1.6 倍。

它同时也是他们测过的所有模型里分数最高的。这才是真实的取舍:你买的是指数顶端,代价是每个任务比以前更花钱,不是更省钱。

除了价格,Anthropic 还说改了什么

Claude Fable 产品页讲的是行为,不是跑分。它写道 Fable 5.1「不走看似省事的捷径,修问题的根因而不是症状,并在工作过程中持续同步进展」。(另一篇发布公告的措辞不一样,所以引用时最好标明出自哪一页。)最有分量的具体说法不是 Anthropic 自己说的。同一页上引了 IMC 首席 AI 工程师 Marquis Wong 的话:「用 Claude Code,对我们测试过的每一个构建失败,它在所有 effort 档位上都正确定位了根因。」

前者是厂商描述自家模型,后者是客户描述自己的测试。两者都不是基准测试,在据此改写路由策略之前,都值得先拿自己手里那些跑挂的构建复现一遍。Anthropic 的发布公告页确实带有完整的基准表——Terminal-Bench-Science、Terminal-Bench、OSWorld、HLE 等等。本文有意不碰这些,只谈钱,因为发布报道里算错的正是成本这条线。

顺带更正一个传得很广的说法:不少地方把「误报变少」当成 Fable 5.1 的新特性。那其实是 2026 年 8 月 7 日针对 Claude Fable 5 生物学护栏的一次更新,Anthropic 称该更新「在我们的各产品界面上,让生物学相关的降级回退减少了约 85%」。那是更早的一次独立更新,和这次发布没有关系。

规格上一个容易被忽略的差别

Fable 5.1Opus 5Sonnet 5
ThinkingAdaptive(常驻)AdaptiveAdaptive
默认 efforthighhighhigh
上下文窗口1M1M1M
最大输出128K128K128K
可靠知识截止2026-062026-052026-01

model ID 是 claude-fable-5-1。三者的上下文和输出上限完全一致,所以真正的区别在价格、行为,以及最后那一行——Fable 5.1 是这三个里可靠知识截止最新的,比 Opus 5 新一个月,比 Sonnet 5 新五个月。碰到近期的库版本和 API 变更,这个差距是实打实的。

Mythos 5.1 出现在同一张价格表里,费率完全相同。Anthropic 的发布公告称两者「是同一个底层模型」,差别「反映的是我们早期那套不够精确的网络安全护栏曾经介入过的那些任务」。访问要走验证计划,两条线进度不一样:生命科学验证计划已经开了邀请制 beta,受邀方现在就能用;网络安全验证计划则是「将在近期纳入 Mythos 模型访问」。目前只面向一批美国机构,不是拿把普通 API Key 就能调的。

怎么选

你的负载结论
长时间跑 agent、缓存复用密集、任务最难Fable 5.1——溢价变小了,但仍然是溢价(尚未上架 Ofox)
复杂的 agent 编码任务、企业场景、在意成本Opus 5——在任何现实配比下都更便宜
高并发、对延迟敏感、质量够用即可Sonnet 5——$2/$10,同样 1M 上下文
已经在 Fable 5 上基础价一样、缓存更便宜、知识截止更靠后——等你的供应商上架后值得迁。目前不在 Ofox 目录里

然后去检查一下缓存 TTL。跑一小时的 agent,就这一个设置牵动的金额,比本文讨论的这次价格变化还大。

如果你更关心的是国产旗舰和 Fable 5.1 之间的价差、以及每任务成本怎么摊,另一篇《Fable 5.1 降价之后:三笔账算下来,每个任务反而贵了 20%》专门算了这笔账。

可用性

截至 2026 年 9 月 2 日,Ofox 目录里是 anthropic/claude-fable-5anthropic/claude-opus-5anthropic/claude-sonnet-5,按 Anthropic 官方定价计费、不加价。Fable 5.1 还没有进目录。想今天就拿真实流量跑一遍这个对比,Fable 5 和 Opus 5 都能用同一把 Ofox Key 调,两种协议都能走:OpenAI 兼容的 https://api.ofox.ai/v1,或 Anthropic 原生的 https://api.ofox.ai/anthropic

价格与规格于 2026 年 9 月 2 日核对自 Anthropic 定价文档、模型文档、产品页与发布公告;每任务成本数据来自 Artificial Analysis,同日取得。

常见问题

Claude Fable 5.1 比 Fable 5 便宜吗?
只在缓存输入这一项上便宜。基础输入仍是每百万 token $10,输出仍是 $50,两项都和 Fable 5 完全一致。变的只有缓存读取,从 $1 降到 $0.25。Anthropic 的说法是这一项降了 75%,可以把典型负载的成本压下来约 25%,重度 agent 场景最多约 45%。如果你的负载很少命中缓存,账单几乎不会动。
Fable 5.1 的缓存读取比 Opus 5 还便宜,那它总成本是不是更低?
不是。Fable 5.1 读缓存 $0.25,确实只有 Opus 5($0.50)的一半,但它的基础输入($10 对 $5)和输出($50 对 $25)都是两倍。把这个不等式解出来会发现,只有当缓存读取占输入超过约 95%,且输出接近于零时,Fable 5.1 的总成本才会更低——现实中不存在这种负载。选 Fable 5.1 应该是为了能力,不是为了比 Opus 5 省钱。
Claude Fable 5.1 的 model ID 和上下文窗口是多少?
model ID 是 claude-fable-5-1。1M token 上下文窗口,最大输出 128K,Adaptive thinking 常驻开启,默认 effort 为 high。可靠知识截止是 2026 年 6 月,比 Opus 5 晚一个月,比 Sonnet 5 晚五个月。
Claude Mythos 5.1 是什么?
Anthropic 表示 Mythos 5.1 与 Fable 5.1「是同一个底层模型」,差别在安全护栏,两者在价格表里费率完全相同。Mythos 的访问要走验证计划,两条线进度不一样:生命科学验证计划已经开了邀请制 beta,受邀方现在就能用;网络安全验证计划则「将在近期纳入 Mythos 模型访问」。目前只面向一批美国机构,不是拿把普通 API Key 就能调的。
现在能在 Ofox 上调 Fable 5.1 吗?
还不能。截至 2026 年 9 月 2 日,Ofox 目录里有 Claude Fable 5、Opus 5 和 Sonnet 5,按 Anthropic 官方定价计费,没有 5.1 条目。想拿真实流量跑一遍本文的对比,Fable 5 和 Opus 5 都能用同一把 Ofox Key 调。