费率核实于 2026 年 7 月 27 日
Claude Fable 5 成本计算器
多数 token 计算器就是把 token 数乘以标价然后结束。真正影响账单的有三件事,这个计算器把三件都算进去了。
它比普通 token 计算器多算了什么
第一,effort 参数让输出量在 low 和 max 之间相差数倍——贵模型跑 low effort 往往才是便宜的那个选项。第二,一部分 Fable 5 请求会命中安全分类器转由 Opus 4.8 回答,计费方式不同,而且你的异常处理看不见它。第三,如果你的 token 数是在 Opus 4.6 或更早的模型上测的,那它偏低约 30%:tokenizer 在 Opus 4.7 时改过,现役模型全部继承了它。这三项漏掉任何一项,你的估算都会朝一个你没选择的方向偏。
月度成本估算
我的 token 数是在 Opus 4.7 之前的模型上测的
Opus 4.7 引入的 tokenizer 会把同样的文本切成多约 30% 的 token。Fable 5、Opus 4.8 和 Opus 5 用的都是它——只有当你的数据测自 Opus 4.6 或更早的模型时才需要打开。
走 Batch API
输入输出各打五折,但不是实时返回。
Claude Fable 5
$238.19
每月 · $5.81/MTok 实际单价
Claude Opus 5
$122.15
每月 · $2.98/MTok 实际单价
Claude Opus 5 更便宜 $116.04 每月(按当前负载)。
- 未命中输入
- $111.15
- 缓存读取
- $25.93
- 输出
- $95.00
- 安全回退
- $6.11
这是估算不是报价。其中两项是建模值而非官方公布值 (1.3x tokenizer, effort estimates) · 费率核实于 2026-09-02
DeepSeek、Qwen、GLM 和 Kimi 的价格为 2026 年 8 月各厂商公布的数据,未经独立核实。下方的 effort 层级倍率是 Anthropic 专属估算,仅作为粗略近似套用于竞品模型。
别人都没建模的三层
每一项都是有据可查的行为,不是猜测——但它们都不体现在标价里。
tokenizer 是在 Opus 4.7 改的,现役模型之间并没有差异
Anthropic 的 token 计数文档写明:Fable 5 和 Mythos 5 使用的是 Opus 4.7 引入的 tokenizer,对同样的文本,它产生的 token 比该版本之前的模型多约 30%。迁移指南给出的区间是 1.0 到 1.35 倍,代码、JSON、XML 和 YAML 处在区间上沿。实际影响比乍看之下要窄:从 Opus 4.8 或 Opus 5 迁到 Fable 5 完全不涉及 tokenizer 变化,因为它们本来就共用同一个。上面那个开关只在你的基准数据来自 Opus 4.6 或更早时才有意义——那种情况下你的预算大约短了三分之一。
effort 让输出量相差数倍
effort 是 API 参数(low、medium、high、xhigh、max,默认 high),不是提示词技巧,它直接决定模型花多少 token。一次公开测量中,同一个 prompt 在 low effort 下产生约 1,900 输出 token,在 max 下约 14,400。Anthropic 没有公布成本曲线,所以这里的倍数是从这一个锚点插值出来的,界面上也标注为估算。
安全回退是要计费的,而且不便宜
当请求触发 Fable 5 的网络安全或生物学分类器时,会改由 Opus 4.8 回答,返回 HTTP 200 加 stop_reason: refusal。计费原则是「谁真正处理了请求就按谁计价」:如果拦截发生在产生任何输出之前——这是常见情形——被拒的 Fable 5 那次尝试完全不计费,整轮按 Opus 4.8 的价格算。真正贵的是中途拦截,因为已经流出的那部分要按 Fable 5 计价。Anthropic 称平均不到 5% 的对话会回退;Artificial Analysis 在一个高难度基准上测到 9%,而要求模型复述推理过程的 prompt 会显著推高这个比例。
这个计算器诚实承认自己不知道的部分
token 数是根据你的输入估算的,不是实测——要精确值请用你真实的 prompt 调 Anthropic 的 count_tokens 接口。effort 倍数是从单一公开测量插值来的,不会匹配所有负载。缓存写入成本没有计入,因为它取决于你的前缀多久变一次。请把结果当作规划区间,不是账单。
在付钱之前先把数字降下来
缓存一份稳定的系统提示词、把常规任务的 effort 降一档、去掉让模型复述推理的指令——这三件事对账单的影响都比换模型更大。