叙事变化:2026 年 7 月 24 日

Opus 5 发布后本页已重写:推荐从「首选 Fable 5」变为「首选 Opus 5」。Anthropic 官方现在的指引是:从 Opus 5 开始,仅在需要最高可用能力的负载上使用 Fable 5。

为什么推荐发生了变化

更新于 2026 年 8 月 4 日

Claude Fable 5 对比 Claude Opus 5

2026 年 7 月 24 日的发布翻转了默认选择:Anthropic 现在建议从价格减半的 Opus 5 起步,只为它仍然占优的四类任务保留 Fable 5。以下是完整的、带来源的对比。

结论先说

默认选 Opus 5——在已发布的 benchmark 上与 Fable 5 处于同一能力档,价格却只有一半($5/$25 对 $10/$50),是 Claude Max 的默认模型,也没有数据留存要求。只有在以下四类场景才升到 Fable 5:长链路 agent 任务、Mythos 级安全编码、1M 上下文全库分析、以及政策要求 30 天留存而 ZDR 不可用的合规场景。完整对比见下文。

规格与价格并排对比

API 列表价取自 src/lib/model-pricing.ts,最近于 2026 年 8 月 4 日对照 Anthropic 官方定价文档核实。做预算前请再确认——两个模型都发布不到两个月。

Claude Fable 5Claude Opus 5
发布日期2026-06-092026-07-24
API 模型 IDclaude-fable-5claude-opus-5
输入 / 每百万 tokens$10.00$5.00
输出 / 每百万 tokens$50.00$25.00
缓存读取 / 每百万 tokens$1.00$0.50
缓存写入(5 分钟)/ 每百万 tokens$12.50$6.25
批量(输入 / 输出)$5.00 / $25.00$2.50 / $12.50
上下文窗口1M1M
最大输出128K128K
数据留存强制 30 天——ZDR 协议不适用常规访问无留存要求
订阅可用性Max / Team Premium,每周池 50%Max 默认 · Pro 最强
快速模式(Claude 应用)Fable 5 不提供约 2.5 倍速,2 倍价($10/$50)

Benchmark:12 项对照,全部标注来源

每行都标注来源:Anthropic = 厂商自家发布材料;AA = Artificial Analysis(独立测试)。对于多个经典 benchmark,Anthropic 没有发布过 Opus 5 的数字——这些行如实写「未确认」,不猜测。

Claude Fable 5Claude Opus 5来源
SWE-Bench Pro80.3%未确认(截至 2026 年 8 月 4 日)
FrontierCode Diamond29.3%未确认(截至 2026 年 8 月 4 日)
Frontier-Bench v0.133.7%43.3%
CursorBench 3.2保持公开最高分距 Fable 5 峰值 0.5% 以内,每任务成本约一半
ARC-AGI 3未测试约为次优模型的 3 倍
Zapier AutomationBench未发布通过率约为次优模型的 1.5 倍
OSWorld 2.0 / OSWorld-Verified85.0%以约 1/3 成本超过 Fable 5 的最好成绩
GDPval-AA19321861
AA-Briefcase未发布1720
Humanity's Last Exam53%53%
Terminal-Bench v2.1未发布89%
AA 智能指数6061

Anthropic:Opus 5 发布公告(2026 年 7 月 24 日)与 Fable 5 发布表(2026 年 6 月 9 日)。AA:Artificial Analysis 关于 Opus 5 的文章(2026 年 7 月 24 日)。Fable 5 的 SWE-Bench Pro 80.3% 与 FrontierCode 29.3% 仍是 Anthropic 为广泛可用模型发布过的最高数字——截至 2026 年 8 月 4 日,Opus 5 在这两项上均未发布成绩。 GDPval-AA 的数字来自不同版本的 harness(Anthropic 6 月 9 日发布表对 AA 的 v2),不可直接比较。

决策矩阵:如果你……就用……

四类升 Fable 5 的场景、默认 Opus 5 的场景,以及预算场景。其余一切从 Opus 5 开始。

  • 你运行多小时的自主 agent

    长链路 agent(30-90 分钟以上、大量工具调用、文件记忆)正是 Fable 5 的定位——Anthropic 称其为「长运行 agent」模型。选 Fable 5。

  • 你做安全关键的编码

    Mythos 级安全工作(抗漏洞代码、防御性工具)是 Fable 5 的地盘——Opus 5 自己在这方面「仍落后于 Mythos 5」。选 Fable 5(或 Mythos 变体)。

  • 你在一个上下文中分析整个仓库

    需要塞满 1M 窗口的全库读取——两个模型都有 1M 上下文,但 Fable 5 在最难编码任务上的峰值(SWE-Bench Pro 80.3%)是已发布的最高点。选 Fable 5。

  • 合规要求留存数据,或 ZDR 不可用

    你的数据政策要求留存日志,或无法获得 ZDR。Fable 5 强制的 30 天留存正是某些政策要求的日志留存——当零数据留存无法签订时,Fable 5 也不存在需要谈判的留存缺口。相比之下 Opus 5 完全没有留存,无法满足要求留存的政策。选 Fable 5。

  • 你正在开启一个新项目

    复杂 agentic 编码和企业工作——Anthropic 官方建议从 Opus 5 开始,而且它已经是 Max 的默认模型。选 Opus 5(high 档)。

  • 你在规模化地优化预算

    高吞吐编码与工具调用,价格只有 Fable 5 列表价的 1/5——Sonnet 5($2/$10 促销价,至 2026 年 8 月 31 日)能覆盖大多数日常任务。选 Sonnet 5。

决策指南截至 2026 年 8 月 4 日,基于 Anthropic 官方指引、已发布 benchmark 与 Anthropic 的套餐文档。你自己的评测永远比任何默认建议可靠。

编码决策:各解什么题、各花多少钱

编码数字,加上真正决定取舍的算术:每解决一个任务的成本,而不是通过率。

  • Agentic 编码 benchmark

    SWE-Bench Pro:Fable 5 的 80.3% 是已发布的最高分——Opus 5 没有发布成绩(未确认)。FrontierCode Diamond:Fable 5 为 29.3%;Opus 5 未发布(未确认)。Anthropic 为 Opus 5 主打的最新 agentic 编码测试 Frontier-Bench v0.1:Opus 5 以 43.3% 胜过 Fable 5 的 33.7%。

  • 真实使用中的表现

    Artificial Analysis 测出 Opus 5 智能指数 61 对 Fable 5 的 60(max 档),Terminal-Bench v2.1 上 Opus 5 为 89%(Fable 5 无发布数字)。Lovable 报告其最难的 agentic 编码内部评测相对 Opus 4.7 提升 22%。Fable 5 的 80.3% 使用的是 Anthropic 自家脚手架——分数只能在相同 harness 内比较。

  • 每解决一个任务的成本

    max 档下,Artificial Analysis 测出 Opus 5 每任务约 $2.03,Fable 5 约 $2.75——省 26%。算例:100 个编码任务,high 档,每个约 1 万输入 tokens(50% 缓存命中)+ 8 千输出。Fable 5 ≈ $45.50;Opus 5 ≈ $22.75。就算 Fable 5 解题率高 2%,也只是多解 2 个;每月 1 万个任务时,这个差价足够养一个团队。

Safeguard 兜底:在 Claude.ai、Claude Code 和 Claude Cowork 上,被 Fable 5 分类器拦截的请求会回退到 Opus 4.8——按 Opus 4.8 价格计费。Opus 5 的网络分类器介入频率比 Fable 5 低约 85%。

一个月真实负载要花多少钱

三种代表性负载按列表价估算,未叠加批量与缓存折扣——真实数字请用成本计算器。

  • Agentic 编码(每月 1,000 任务)

    Fable 5 ≈ $1,720 · Opus 5 ≈ $860

  • 1M 上下文分析(每月 50 次)

    Fable 5 ≈ $470 · Opus 5 ≈ $235

  • 高吞吐客服(每月 20 万请求)

    Fable 5 ≈ $12,750 · Opus 5 ≈ $6,375 · Sonnet 5 ≈ $2,550(促销价)

按 API 列表价估算:输入 50% 缓存命中,agentic 运行输出 +30%。你的真实用量请用计算器精确计算。由于 Opus 5 每个答案消耗的 tokens 可能多于 Fable 5,实际差距往往小于列表价的 2 倍——永远不要只凭列表价做预算。

打开成本计算器

决定企业合同成败的差异

Fable 5 出于安全监控有强制 30 天留存窗口,零数据留存(ZDR)协议对它不适用。Opus 5 常规访问没有数据留存要求——Anthropic 发言人在发布会上主动提起这一点,专门针对有硬性 ZDR 需求的客户。如果合规审查曾在你们公司拦下 Fable 5,这个障碍在 Opus 5 上不存在。

Fable 5 的独有角度:benchmark 看不见的分流机制

有三件事把两个模型分开,而任何 benchmark 表都不会显示。

  • 分类器驱动的请求分流

    Fable 5 的安全分类器会把被标记的请求分流到 Opus 4.8(Claude.ai、Claude Code、Claude Cowork)或 Opus 5(7 月 24 日起的生物学请求)。Opus 5 的网络分类器介入频率低约 85%。

  • 30 天留存是强制的

    Fable 5 出于安全监控要求 30 天留存,且被排除在 ZDR 协议之外。Opus 5 常规访问没有留存要求。

  • 真正的天花板是 Mythos 5

    网络安全与生物学的最高已发布分数属于 Mythos 5(仅限受邀,通过 Project Glasswing)。Fable 5 是广泛可用的那一档;Opus 5 在这些领域「仍落后于 Mythos 5」。

Fable 5 仍然值得选的四种情况

溢价仍然值得付出的四类场景——即决策矩阵里的升级场景。

  • 长链路自主运行就是任务本身

    带文件记忆的多小时 agent 运行正是 Fable 5 的定位,它在这类场景的公开运行记录也更长。Anthropic 称其为「长运行 agent」模型。

  • 你需要 Mythos 级的安全工作

    在网络安全与生物学上,Opus 5 自己也承认仍落后于 Mythos 5——而 Fable 5 是该家族广泛可用的层级。如果你的负载是安全关键编码,这根本不是价格问题。

  • 你在 Max 且还在每周 50% 池内

    Max 与 Team Premium 每周额度的 50% 以内包含 Fable 5。在池内边际成本为零——算法完全不同。

  • 你的 harness 已调好,账单也能接受

    迁移只是一行改动,但并非免费——提示缓存、effort 档位、评测都要重来。如果现状稳定、账单可接受,就没有紧迫性。

如何切换

两个模型的请求格式相同,大多数代码库里只需改一行。

  • API——改模型 ID

    把 claude-fable-5 换成 claude-opus-5。effort 参数(两者默认都是 high)、不存在的 temperature/top_p/top_k、自适应思考全部原样沿用。Opus 5 还新增了 API 自动兜底路由。

  • Claude Code——/model opus

    在会话里运行 /model opus,或设置 ANTHROPIC_MODEL=claude-opus-5。在 Max 上 Opus 5 本来就是默认——你可能从 7 月 24 日起就一直在用它。

  • Claude 应用——Max 上什么都不用做

    发布当天 Opus 5 就成为 Claude Max 的默认模型、Claude Pro 的最强模型,订阅价格不变。

切换之前,先算清你的真实负载

把真实的月度用量在两个价位下各跑一遍计算器——叠加缓存与批量后,差距往往比列表价的 2 倍还大。

常见问题