Claude Fable 5.1 在 Anthropic API 上的价格是每百万输入 token 10 美元、每百万输出 token 50 美元,缓存读取每百万 0.25 美元——所有费率均于 2026 年 9 月 22 日在 Anthropic 官方定价文档核对。这就是费率卡,而且它平淡得近乎无聊:五个 token 线项里有四个和 Fable 5 完全相同。账单却是另一回事。同一张费率卡上,Artificial Analysis 实测同一个基准任务低推理档 2.37 美元、max 档 7.63 美元——一个价格数字都没动,成本就摆动了 3.2 倍;另有独立测量显示 Fable 5.1 的单任务成本比 Fable 5 高 18%,尽管发布宣传写着"最多便宜 45%"。
这两句话都是真的,它们之间的落差正是本文存在的原因。r/LLMDevs 的一位开发者把真实问题说得最准:GPT-6 Astra 和 Fable 5.1"标价相同,实际成本不同"——因为决定账单的是你的流量形状,不是标价(r/LLMDevs)。本文是我们 Claude Fable 5.1 总览和测评的"钱的那一半";后文会介绍 Tabbit Browser 作为预算清楚后实际运行对比的一个选择。先看数字。
关键结论
费率卡: 每百万 token 输入 10 美元、缓存读 0.25 美元(0.025x——全家族唯一特例)、缓存写 12.50/20 美元(5 分钟/1 小时)、输出 50 美元。Batch 全线五折;仅美国推理每条线项 1.1 倍。
只有一行动了,其余都是账单形状。 缓存读比 Fable 5 的 1.00 美元下降 75%。Anthropic 估计典型负载省约 25%、agentic 负载最多省约 45%;独立实测落在 15–30%,还有一个记录完整的社区构建实测比 Fable 5 贵 2.4 倍。
推理档是最大的可控杠杆。 AA 的阶梯显示低档到 max 档每任务成本 2.37 → 7.63 美元,智能分只从 47 涨到 53。Fable 在 Claude Code 默认 High 档,其他界面默认 Medium——先确认你付的是哪一档的钱。
没有长上下文断崖。 完整 100 万 token 窗口按标准价计费——不像部分竞品会对长提示重新定价——但新分词器对同样文本多产生约 30% token。
订阅是另一套经济系统。 Fable 不在免费版;Pro/Max 按"每周限额 50% 的 usage credits"计量,叠加 5 小时滚动窗口。Enterprise 为每席位 20 美元/月加 API 费率用量。
Claude Fable 5.1 费率速览
完整标准费率卡,来自 Anthropic 定价文档(2026 年 9 月 22 日核对)。Mythos 5.1——同一套权重、受限访问计划——标价完全相同但一般买不到;谱系关系见总览页。
| 模型 | 输入 / 百万 | 5m 缓存写 / 百万 | 1h 缓存写 / 百万 | 缓存读 / 百万 | 输出 / 百万 |
|---|---|---|---|---|---|
| Claude Fable 5.1 | $10.00 | $12.50 | $20.00 | $0.25 | $50.00 |
| Claude Fable 5 | $10.00 | $12.50 | $20.00 | $1.00 | $50.00 |
| Claude Opus 5 | $5.00 | $6.25 | $10.00 | $0.50 | $25.00 |
| Claude Sonnet 5 | $2.00 | $2.50 | $4.00 | $0.20 | $10.00 |
| Claude Haiku 4.5 | $1.00 | $1.25 | $2.00 | $0.10 | $5.00 |

这张表里真正决定账单的是三件事,没有一件是 headline 的 10 美元:
输出是输入的 5 倍价。 Fable 是自适应推理模型,它用可计费的输出 token 思考。一个短提示加一条长推理链,本质上是一张穿着输入外衣的输出账单。
缓存写入比输入还贵。 5 分钟条目 12.50 美元是基准价的 1.25 倍,1 小时条目 20 美元是 2 倍。5 分钟档读一次、1 小时档读两次就回本——前提是前缀真的被复用。
分词器在你脚下换了。 按 Anthropic 官方脚注,Claude 4.7 及之后模型使用的新分词器对同样文本多产生约 30% token。拿 token 单价直接对比 Sonnet 4.6 时代模型而不做这项校正,会把旧模型成本高估三分之一。
还有一点值得钉死:完整 100 万 token 上下文按标准价计费——用 Anthropic 的话说,"一个 90 万 token 请求和一个 9 千 token 请求的单价相同"。与 GPT-6 Astra 的 27.2 万断崖(越过阈值后整个请求重新定价)不同,Fable 完全没有长上下文档位。
唯一变化的数字:缓存读下降 75%
提示缓存是 Fable 5 到 5.1 之间唯一移动的线项,值得从机制上理解它——因为 agent 循环就活在这一行上。
当一个请求重复此前已处理过的提示前缀——系统提示、仓库上下文、对话历史、工具定义——API 可以从缓存读取该前缀而不必重新处理。写入按基础输入价的 1.25 倍(5 分钟条目)或 2 倍(1 小时条目)收费;读取通常按 0.1 倍收费。Fable 5.1(和 Mythos 5.1)是全家族例外:读取按 0.025 倍计价——每百万 0.25 美元,Anthropic 的脚注明确标注了这一点。这些乘数可与 Batch 折扣、数据驻留定价叠加。
为什么它主导 agent 账单:一个在 20 万 token 上下文上做 40 次工具调用的 agent,会把这段前缀重读 40 次。按 Fable 5 的 1.00 美元读取价,这些重读花费 8.00 美元;按 Fable 5.1 的 0.25 美元,只花 2.00 美元——这还发生在一个新 token 生成之前。社区数据指向同一方向。一位在 Fable 5.1 与竞品(1.00 美元读取价)上各跑了一周文档检索流水线的开发者报告:85% 缓存命中率下,总成本约为对方一半:

在 r/ClaudeCode,一位把"Fable 5 规划 + Opus 5 写码"组合换成 Fable 5.1 直接写码(Medium 档)的 Django 开发者算出:每请求省约 37%,每输出 token 省约 52%——用他自己的话说,"原因几乎完全是缓存定价":

两条报告的共同前提:缓存省钱需要稳定的前缀。如果你的上下文每轮都在变——动态工具输出、轮换的文档——你会不断支付 1.25–2 倍的写入罚金,而不是享受 0.025 倍的读取价。这个失败模式正是下一节要测量的东西。
"最多便宜 45%"到底什么意思
Anthropic 的发布声明有精确的适用条件,把它们拆开读,是"预算"和"愿望"之间的区别。动手做预算前有两个必须知道的 caveat。
Caveat 一:基线与条件。"Fable 5.1 对典型负载估计比 Fable 5 便宜 25%……对高度 agentic 的工作,节省常常大得多——最多约 45%。"基线是 Fable 5,不是竞品;声明只覆盖按 token 计费的用量;"高度 agentic"指反复重读大型稳定前缀的负载——即上一节的缓存读形状。它不是对你"完成任务成本"的承诺。
Caveat 二:独立测量发现了相反方向。Artificial Analysis 实测 Fable 5.1 在其智能指数上消耗 1.4 亿输出 token,而 Fable 5 是 8,300 万,把单任务成本推高 18%(3.14 → 3.69 美元)。Firecrawl 的57 次运行测量(2026 年 9 月 7 日)发现 Fable 5.1 在每一档 effort 上都用了更多输出 token——低档 1.37 倍、高档 1.12 倍、max 档 1.30 倍——实际节省是账单的 15–30%,而非 25–45%,"因为(1 小时)缓存写入每百万 20 美元且不打折"。他们的结论值得引用:"Anthropic 说 Fable 5.1 更便宜……Artificial Analysis 实测它贵了 18%。两边都测对了。"你的账单更像哪一边,取决于哪种 token 占主导。
社区在野外找到了这个失败模式。一位 r/ClaudeCode 开发者用同一个构建 prompt 跑两个模型:Fable 5.1 花了 1,200 美元,Fable 5 花 500 美元——2.4 倍,headline 费率完全相同:

他的复盘:Fable 5.1 把 57% 的子任务委派给了Opus 工作模型(按 Opus 费率计费),而 Fable 5 有 80% 路由到 Sonnet;推理循环还把活跃上下文膨胀到 40 万 token 以上——"支付沉重的写入罚金,而不是搭上便宜的缓存读"。教训不是"Fable 5.1 贵",而是委派档位和上下文抖动本身就是计费线项,任何费率卡上都没有它们。这笔权衡的能力侧见测评与我们的 agentic 推理指南。
推理档杠杆:每任务 2.37 到 7.63 美元
Fable 5.1 提供自适应推理档位(effort)——而费率卡上没有任何一行告诉你,这个旋钮对成本的影响超过所有价格线。Artificial Analysis 把它当作五个独立条目跟踪;2026 年 9 月 22 日快照:
| 推理档 | 智能指数 | 每任务成本 | 输出速度 |
|---|---|---|---|
| low | 47 | $2.37 | 55 t/s |
| medium | 49 | $2.98 | 57 t/s |
| high | 51 | $3.91 | 56 t/s |
| xhigh | 53 | $5.98 | 63 t/s |
| max | 53 | $7.63 | 67 t/s |
把外侧两列一起读:max 档每任务成本是 low 档的 3.2 倍,换来的智能分只有 6 分。 low 档的首 token 延迟也最低(同一快照 8.47 秒)。贵的档位不自动等于更仔细;它只是在可计费输出 token 里想得更久——Firecrawl 的数据显示差距几乎全部来自隐藏推理 token(max 档:推理 token 4,205 → 6,725,可见文本反而少了 6%)。
Anthropic 自己的默认值让这成为一个现实决策:Fable 5.1 在 Claude Code 默认 High 档,在 Claude Cowork 和 Claude.ai 默认 Medium 档。同一个任务在两个界面里,从第一个 token 起就计费不同。发布说明难得直白:Low 或 Medium 档"以低得多的成本取得与 Fable 5 相近或更好的结果"——厂商亲口告诉你便宜档通常够用,这是礼物,收下。
headline 之外的计费线项
四条线决定大多数真实账单,而发布报道通常只覆盖第一条。
Batch:五折杠杆。 异步 Batch 请求在 Fable 5.1 上按输入 5 美元/输出 25 美元计费——整卡最大的折扣,且与提示缓存叠加。评测跑批、夜间重构、一切非用户面对面工作,这一个开关比任何提示词优化都省。托管 agent 会话不适用(有状态、交互式)。
仅美国推理:全线 1.1 倍。 设置 inference_geo: "us"(或 Azure 美国数据区部署)会把每一类线项乘以 1.1,包括缓存读。合规驱动的区域为每一行安静地多付 10%;global 路由是默认且更便宜的路径。
工具开销就是 token 账单。 声明 browser-use 工具集每次请求增加约 6,600 输入 token;computer-use 约 4,500;bash 工具定义 325。服务端网页搜索在 token 之外按每千次 10 美元计费。一个"agent"是一种定价结构,不是一次聊天——浏览器自动化工作流应该把工具集这一行单列进预算。
Batch 和驻留都修不好的东西:重试、子代理扇出(每个路由到 Opus 的子任务按 Opus 费率计费),以及分词器相对 4.7 前模型约 30% 的 token 膨胀。它们都不在费率卡上,但都会出现在账单上。
家族阶梯:Fable 5.1 vs Opus 5 vs Sonnet 5
| 线项(每百万 token) | Fable 5.1 | Opus 5 | Sonnet 5 |
|---|---|---|---|
| 输入 | $10.00 | $5.00 | $2.00 |
| 缓存读 | $0.25(0.025x) | $0.50(0.1x) | $0.20(0.1x) |
| 输出 | $50.00 | $25.00 | $10.00 |
| Batch 输入 / 输出 | $5.00 / $25.00 | $2.50 / $12.50 | $1.00 / $5.00 |
反直觉的一行是缓存读:家族里最贵的模型有最便宜的缓存读——比家族标准乘数低 4 倍。Anthropic 把 agent 循环砸得最狠的那条计费线,定出了最低的比率。如果你的流量反复重读大型稳定上下文,Fable 的有效输入价会坍缩;如果不是,headline 减半、缓存读比率加倍的 Opus 5 可能更划算——Firecrawl 发现紧凑规格的任务在 Opus 5 上"每次"都更便宜,而开放式构建平均 Opus 11.83 美元、Fable 5.1 是 7.00 美元。
阶梯上还有两个值得钉死的事实:Sonnet 5 的 2/10 美元本是到 2026 年 8 月 31 日截止的促销价——Anthropic 已将其转为标准价,取消了原定 9 月 1 日涨到 3/15 美元的计划。同价陷阱还跨家族存在:Fable 5.1 和 GPT-6 Astra 都标价 10/50 美元,实际成本方向相反——Astra 用更少 token 完成长单任务,Fable 的 0.25 美元读取赢下任何高频缓存上下文负载。r/LLMDevs 的分析原文:

Anthropic 自己的定位与阶梯一致:Fable 5.1 面向"雄心勃勃、长时间运行、异步"的工作——测评覆盖该结论何时成立——日常交互工作交给 Opus 和 Sonnet。
你不用付钱的部分
定价文档和产品页划出了几条读起来像退款政策的边界,在 agentic 规模下它们真的影响账单:
护栏转写不按 Fable 价格计费。 被网络安全或生物学护栏标记的查询由 Opus 4.8 或 Opus 5 完成——产品页原文:"转写请求不会按 Fable 价格向你收费。"安全话题上一个感觉被拒答的回答,可能 literally 是一个更便宜的 Opus 回答。
失败的网页搜索不计费。 成功的搜索按每千次 10 美元计费,出错的那些不计。网页抓取除 token 外不额外收费。
代码执行与搜索/抓取同用时免费,且每个组织每月有 1,550 免费 container 小时,之后才开始按每小时 0.05 美元计。
平衡的另一面:配额不是钱,但行为像钱。订阅版上 Fable 消耗 5 小时窗口的速度很快——一位 r/ClaudeAI 用户报告一天内 30% 用量消失在一次调试会话里("我不会让它去 spawn Opus 5 agent"),Every 周测视频的评论区也有人报告 10–20 分钟耗尽一个 5 小时窗口。这些是自报的套餐体验、不是基准,但方向与 API 数学一致:委派和推理档决定燃烧速度。付费套餐的 usage credits 允许超限后按标准 API 费率继续工作。

套餐可得性:API、云与消费订阅
API 费率卡只是三套经济系统之一。以下在 claude.com/pricing 与平台文档于 2026 年 9 月 22 日核对:
| 渠道 | 价格(页面实际显示) | Fable 5.1 可得性 |
|---|---|---|
| Anthropic API | 上文 token 费率 | 是——claude-fable-5-1 |
| 免费版 | $0 | 否(仅 Sonnet/Haiku) |
| Pro | 年付 $17/月(预付 $200)或月付 $20 | 是——usage credits,每周限额的 50% |
| Max 5x / 20x | $100/月起 | 是——同一 credits 规则,Pro 用量的 5x/20x |
| Team 标准 / 高级 | 年付每席位 $20 / $100,月付 $25 / $125 | 是——高级 = 标准的 5 倍 |
| Enterprise | 年付 $20/席位/月 + 按 API 费率的用量 | 是,含支出管控 |
| 云平台 | AWS Bedrock、Google Cloud、Microsoft Foundry | 是;区域端点 +10%,Foundry 以 CCU 计量 |
决定真实成本的订阅机制:用量按5 小时滚动会话窗口重置,付费套餐再叠加每周限额;网页、桌面、移动端和 Claude Code 共用一个池;Pro 每窗口"至少 5 倍"于免费版,Max 是 Pro 的 5x/20x。Fable 在 Pro/Max 上具体按每周限额 50% 的 usage credits 扣减——一小时的 Fable 对你的额度来说等于两小时的 Sonnet,这就是上文"烧完窗口"报告背后的算术。
第三方通道各有条件:OpenRouter 的 Fable 页面注明该通道数据保留不可豁免,其 Bedrock 端点迁移期间仅支持 BYOK。默认档位也因界面而异——Claude Code 是 High,网页是 Medium——同一份订阅在 不同工作界面的消耗速度不同。

两组算例,所有假设摊开
标准费率,无重试、无工具、不含税。这是算术演示,不是预测。
一个短问题和一段长思考。 输入 10,000 token,输出 2,000:
(10,000 × $10 + 2,000 × $50) / 1,000,000 = $0.20大型仓库上的冷启动 agent 循环。 输入 300,000 token(仍是标准价——没有长上下文档位),输出 8,000:
(300,000 × $10 + 8,000 × $50) / 1,000,000 = $3.40同一循环的暖启动版本。 同样 300,000 token 上下文,90% 缓存命中,每会话一次 1 小时写入,输出 8,000:
(270,000 × $0.25 + 30,000 × $10 + 300,000 × $20 + 8,000 × $50) / 1,000,000 = $0.97 + 写入第三行就是这次发布的全部故事浓缩成一次计算:前缀保持稳定时,同样的工作从 3.40 美元掉到 1 美元以下——而上下文抖动、重试或 Opus 路由的子代理一出现,它就爬回去。模型资源页和提示词库收录了可以用来实测你自己命中率的可重复任务。
本地计算
估算 Claude Fable 5.1 API token 成本
使用 2026-09-22 核对的官方美元费率。输入值仅在浏览器本地处理。
缓存命中按每百万 token $0.25 计费——Fable 系 0.025x 特例。该估算不含重试、工具开销、护栏转写和代理商加价。仅美国模式对所有线项生效。 核对最新费率
计算器完全在本页运行——任何数据都不会外发。它对两种缓存写入时长、Batch 与仅美国模式计价,并在本地校验输入。它刻意不建模的东西:重试、子代理档位路由、工具开销和护栏转写——这些属于你的余量。提交预算前请重新核对官方费率卡;本文数字截至 2026 年 9 月 22 日。
一个实用选项:在 Tabbit 里跑对比
预算算清之后是枯燥的部分:真正跑 Fable 形态的工作,需要一个页面、文件和模型调用待在一起的地方,让"用 Medium 档试 Fable、不合适退回 Sonnet"变成一次选择而不是一个编排项目。这就是 Tabbit Browser填补的空档——一个 agentic AI 浏览器,模型选择器、实时标签页和本地文件共享同一个界面。

边界照实说:Tabbit 是客户端,不是 Anthropic 的计费层。模型可得性取决于你的账户与版本,浏览器里的任何东西都不会改变 Anthropic 收什么费——上文费率卡在 Fable 运行的任何地方都适用。本文没有在 Tabbit 内运行 Fable 任务,因此不在这里做任何可得性或性能声明。浏览器改变的是设置成本:本文整页都在说决定你账单的两个数字——你自己的缓存命中率和推理档阈值——在真实工作上测它们,在为这个场景打造的工作台里最便宜。Tabbit 使用习惯指南讲方法;AI 浏览器总览是通用起点。
Claude Fable 5.1 定价决策表
| 你的负载 | 成本主导项 | 最佳起步路径 | 注意 |
|---|---|---|---|
| 长 agent 循环、稳定仓库/文档上下文 | 缓存读 | 标准档 + 前缀稳定 + 1h 写入 | 上下文抖动会把读取变回 1.25–2 倍写入 |
| 短对话、快改写 | 输出 token | 更低推理档——或 Sonnet 5 | $50/M 输出占主导;Fable 是杀鸡用牛刀 |
| 夜间评测、批量重构 | 体量 | Batch API 五折 | 交互式/托管 agent 会话不适用 |
| 开放式自主构建 | 委派 + 输出 | 限制子代理档位;让 Fable 自己写码 | Opus 路由的子代理按 Opus 费率计费 |
| 合规要求的美国内处理 | 每条线项 | 仅美国 1.1x + 允许处用 Batch | 加价同样作用于缓存读 |
| 订阅制日常使用 | 5 小时窗口 + credits | Pro/Max,credits 按每周限额 50% | High 默认档几分钟就能烧完窗口 |
最终裁决
Claude Fable 5.1 的定价像一种面向长期工作的原材料,而且这次发布真的移动了一个数字:每百万 0.25 美元的缓存读让缓存上下文 agent 循环比 Fable 5 显著更便宜——独立实测的落地节省在 15–30%,你的实际数字由命中率而非标价决定。为这种形状的工作买它,用能通过验收检查的最低推理档,限制委派档位,能等的全部走 Batch。至于短交互任务、紧预算或高频变化上下文——家族阶梯存在的意义就是让旗舰成为一个路由决策而非默认选择;在订阅上,请把 5 小时窗口当作真正的账单。
每月复核官方定价页:Sonnet 5 的转正说明这条阶梯会动。总览和测评讲能力;上文社区记录讲负载证据;跨家族定价对比展示同样标价在别处的成本。
来源
Anthropic 定价文档——费率卡、缓存乘数、Batch、驻留、工具计价;2026 年 9 月 22 日核对
Anthropic 发布页与 Claude Fable 产品页——节省声明、默认档、转写计费、可得性;2026 年 9 月 22 日核对
claude.com/pricing——Free/Pro/Max/Team/Enterprise 套餐与 Fable 可得规则;2026 年 9 月 22 日核对
Artificial Analysis 发布页——推理档智能、速度、单任务成本快照;2026 年 9 月 22 日核对
Firecrawl:57 次运行成本测量——token 比率、落地节省、任务规格影响;2026 年 9 月 7 日
OpenRouter Fable 5.1——供应商费率与通道条件;2026 年 9 月 22 日核对
附截图与条件的社区记录:r/ClaudeCode $1,200 vs $500、r/ClaudeCode 省 37%、r/LLMDevs 同价分析、r/ClaudeAI 配额燃烧、Every 周测视频评论
常见问题
Claude Fable 5.1 多少钱?
在 Anthropic API 上,Claude Fable 5.1 为每百万输入 token 10 美元、每百万输出 token 50 美元,均于 2026 年 9 月 22 日在 Anthropic 官方定价文档核对。提示缓存写入为每百万 12.50 美元(5 分钟)或 20 美元(1 小时),缓存读取为每百万 0.25 美元。Batch API 全线五折至 5/25 美元,仅美国推理对每条线项加收 1.1 倍。
Claude Fable 5.1 比 Fable 5 便宜吗?
取决于哪种 token 占你账单的主导。Anthropic 估计典型负载便宜约 25%,高度 agentic 负载最多便宜约 45%,全部来自缓存读降至每百万 0.25 美元。但 Artificial Analysis 实测其单任务成本上升 18%,因为 Fable 5.1 输出更多推理 token。反复重读稳定缓存上下文的负载更省钱;持续生成新输出或上下文频繁变化的负载可能更贵。
Claude Fable 5.1 在免费版里能用吗?
不能。Anthropic 的套餐对比表标注 Free 档不含 Fable。它面向 Pro、Max、Team 和 Enterprise 用户开放;在 Pro 和 Max 上,Fable 用量按每周限额 50% 的 usage credits 扣减。免费版用户只能使用 Sonnet 和 Haiku 系列模型。
运行 Claude Fable 5.1 最省钱的方式是什么?
按顺序叠加杠杆:保持提示前缀稳定,让读取按每百万 0.25 美元而不是 10 美元计费;在能通过验收检查的前提下用最低推理档;把不着急的工作走 Batch API 享五折;合规无要求就不要开仅美国推理。同时限制委派:被路由到 Opus 5 的子代理按 Opus 费率计费,是最常见的隐性成本项。
Claude Fable 5.1 长上下文要加钱吗?
不用。Anthropic 对完整 100 万 token 上下文窗口按标准单价计费,没有长上下文档位或阈值重定价;提示缓存和 Batch 折扣覆盖整个窗口。这不同于 GPT-6 Astra 等旗舰——其输入超过 27.2 万 token 后整个请求按更高的长上下文档率重新计价。
护栏转写或失败的工具调用会按 Fable 价格计费吗?
不会。Anthropic 明确说明被网络安全或生物学护栏自动转写的查询不按 Fable 价格收费,而是由 Opus 4.8 或 Opus 5 完成回答。失败的网页搜索不计费,网页抓取不额外收费,与搜索/抓取工具一起使用的代码执行也免费。