套餐规则会变——使用前先核实
Usage credits 机制与 Fable 5 的套餐包含规则在 2026 年 7 月有过变动——Max 与 Team Premium 现包含 Fable 5,最多占每周用量上限的 50%。最新的包含与限额规则以 Max 套餐页为准。
查看 Max 套餐页Claude Max 与 Pro · 计费指南
Claude Fable 5 的 usage credits,一篇讲透
同一个模型,两张完全不同的账单。这里是 usage credits 的机制、你的 Max 额度为什么掉得这么快,以及哪些设置能拦住意外扣费。
TL;DR — 30 秒结论
Usage credits 是付费套餐(Pro、Max 5x、Max 20x)的按量计费机制:套餐包含的额度用完后,用它按标准 API 价格继续使用 Claude。Fable 5 当前按每百万输入 token $10、每百万输出 token $50 计费,且与订阅费分开扣——你买的是 token,不是另一份套餐。它与直连 API 完全无关:走 API 的代码在 API 账户上按 token 计费,永远不会动用你套餐里的余额。在 Max 上,Fable 5 最多占用周额度的 50%(2026 年 7 月 20 日起);超出这一份额,或在 Pro / Team Standard 上,Fable 5 就按 credits 计费。想设上限,去 Settings → Usage:月度消费上限、自动充值、用量提醒都在那里。跑长 agent 任务之前先设好上限,别等跑完再后悔。
Usage credits 是什么(以及不是什么)
一个模型,两条永不交汇的计费通道。
套餐内:credits 是溢出通道
Pro、Max 5x 与 Max 20x 都包含每周用量额度。额度用完后,usage credits 让你按标准 API 价格继续使用,而不是被拦下。会话限额仍照常每五小时重置,credits 与订阅费分开收取。
API 是另一本账
直连 API 在 API 账户上按 token 计费——输入、输出、缓存读取按公布的价格收。套餐余额永远不会支付 API 调用,API key 也永远花不到套餐的 credits。估算成本前先分清你在哪个界面。
credits 解决什么问题
Anthropic 的说法是:credits 让你在包含额度用完后无缝继续——这是为「token 大户」模型保持工作流付出的价格。在 Pro 与 Team Standard 上,Fable 5 通常从第一次请求起就走 credits。
额度为什么掉得这么快
Fable 5 的周份额是一个上限,而好几股力量同时在把你推向它。
token 是唯一的货币
你发送和接收的一切都计费:输入、输出、prompt 缓存读取,以及 Fable 5 回答前思考产生的 reasoning token。输入越长、回答越长,扣得越多。
Claude 与 Claude Code 合并计数
对话与 Claude Code 终端会话的用量加在一起计入同一份额度——写一天代码和聊一天天烧的是同一个池子。
Research 模式与大上下文会成倍放大
Anthropic 明确提示 research 会话消耗 token 更快——多次搜索加长分析。挂载的项目文件与文档也算进上下文:处理过的每一个 token(包括项目内容)都计费。
effort 档位放大输出侧
Fable 5 的 effort 设置控制模型投入多少推理。档位越高,输出 token 越高于 high 基线(估算 xhigh 约 1.45 倍、max 约 1.9 倍),而输出恰恰是贵的方向——每百万 token $50。
Agent 任务让计费器循环转
自主运行的 Claude Code 会话每一步都要重读同一份上下文。一个长任务可能产生几十次带大上下文窗口的请求,每次都计输入加输出——这是摸到周上限最快的路。
典型任务各消耗多少
credits 的扣减遵循 API 的 token 算法,所以下面按 Fable 5 标准价(每百万 $10/$50)估算。effort 影响输出列;缓存、上下文大小与 agent 循环影响输入侧。你的实际数字会不同——这里展示的是量级。
| 任务 | high 档 | max 档 |
|---|---|---|
| 分析一份 200K token 的长文档 | ≈$1.16 | ≈$1.34 |
| 分析 1M token 的上下文 | ≈$5.41 | ≈$5.95 |
| 一次 agent 任务,20 步 | ≈$5.85 | ≈$7.65 |
估算与成本计算器共用同一函数,按单次 Fable 5 请求计算。长文档:200K 输入 token(70% 命中缓存)+ high 档 4K 输出。1M 上下文:1M 输入(70% 命中缓存)+ 12K 输出。Agent:20 步 × 40K 输入(70% 命中缓存)+ 每步 2K 输出,输出倍率 high 1×、max 1.9×。1M 上下文任务的一步,光输入就超过大多数单次请求。
一个长 agent 日就能单独啃掉 Max 周额度的一大部分。usage credits 还设有每日 $2,000 的赎回上限。
用量监控与消费上限
全部在 Claude 应用的 Settings → Usage 里,不需要额外工具。
用量面板
实时用量、本月 credits 花费与历史记录,套餐包含额度与 credits 消费分开显示。觉得额度掉得快,先看这里。
月度消费上限
设置你每月愿意为 usage credits 花的最高金额。这是唯一能让失控的 agent 任务「花固定数」而不是「花多少算多少」的设置。
自动充值
余额低于你设定的阈值时自动充值——方便,但也可能在你想停的地方继续花。上限仍然是更稳妥的默认选择。
用量提醒
接近消费上限时收到通知。打开不费事、值得开:很多人都是收到第一条提醒才发现 research 模式吃 token 有多快。
知道哪些能改、哪些不能
你可以给 usage credits 设上限,也可以整个关掉——关掉后只剩套餐包含的额度。Max 上 Fable 5 的 50% 份额由周上限决定,不是 credits 设置。另外,Anthropic 保留通过周/月上限自行限制用量的权利。
Max 5x 对 Max 20x:额度能覆盖多少
两个带真实 workload 数字的算例,按 Fable 5 的 API 价格。周额度以相对倍数(相对 Pro 的 5x/20x)表述、不公布小时数或 token 数,所以绝对数字请当作估算。
Max 5x($100/月)
每会话的用量是 Pro 的 5 倍。按 Fable 5 的价格,单次 200K 文档分析约 $1.15–1.35,1M 上下文分析约 $5.50–6,连续一小时 200K 上下文分析约合 $70 的 token。20 步、每步重读 1M 上下文的 agent 任务大约 $100。Anthropic 公布了倍数但没有公布池子大小——重度使用的一天就可能顶到周额度。
Max 20x($200/月)
Pro 的 20 倍——以 2 倍价格拿到 4 倍于 5x 的池子,重度使用下单位成本更低。agent 密集的一周(比如 5–10 次 1M 上下文的任务,约合 $500–1,000 的 Fable 5 token)在这里从容得多。额度用完后,usage credits 按相同价格接管。
周额度只以相对倍数(相对 Pro 的 5×、20×)公布——Anthropic 不公布小时数或 token 数。池子能撑多久取决于你的上下文大小、缓存与 effort 组合;以上绝对数字请当作量级估算。每日 $2,000 的赎回上限与你的月度消费上限适用于 usage credits。