叙事变化:2026 年 7 月 24 日
Opus 5 发布后本页已重写:推荐从「首选 Fable 5」变为「首选 Opus 5」。Anthropic 官方现在的指引是:从 Opus 5 开始,仅在需要最高可用能力的负载上使用 Fable 5。
为什么推荐发生了变化更新于 2026 年 8 月 4 日
Claude Fable 5 对比 Claude Opus 5
2026 年 7 月 24 日的发布翻转了默认选择:Anthropic 现在建议从价格减半的 Opus 5 起步,只为它仍然占优的四类任务保留 Fable 5。以下是完整的、带来源的对比。
结论先说
默认选 Opus 5——在已发布的 benchmark 上与 Fable 5 处于同一能力档,价格却只有一半($5/$25 对 $10/$50),是 Claude Max 的默认模型,也没有数据留存要求。只有在以下四类场景才升到 Fable 5:长链路 agent 任务、Mythos 级安全编码、1M 上下文全库分析、以及政策要求 30 天留存而 ZDR 不可用的合规场景。完整对比见下文。
规格与价格并排对比
API 列表价取自 src/lib/model-pricing.ts,最近于 2026 年 8 月 4 日对照 Anthropic 官方定价文档核实。做预算前请再确认——两个模型都发布不到两个月。
| Claude Fable 5 | Claude Opus 5 | |
|---|---|---|
| 发布日期 | 2026-06-09 | 2026-07-24 |
| API 模型 ID | claude-fable-5 | claude-opus-5 |
| 输入 / 每百万 tokens | $10.00 | $5.00 |
| 输出 / 每百万 tokens | $50.00 | $25.00 |
| 缓存读取 / 每百万 tokens | $1.00 | $0.50 |
| 缓存写入(5 分钟)/ 每百万 tokens | $12.50 | $6.25 |
| 批量(输入 / 输出) | $5.00 / $25.00 | $2.50 / $12.50 |
| 上下文窗口 | 1M | 1M |
| 最大输出 | 128K | 128K |
| 数据留存 | 强制 30 天——ZDR 协议不适用 | 常规访问无留存要求 |
| 订阅可用性 | Max / Team Premium,每周池 50% | Max 默认 · Pro 最强 |
| 快速模式(Claude 应用) | Fable 5 不提供 | 约 2.5 倍速,2 倍价($10/$50) |
Benchmark:12 项对照,全部标注来源
每行都标注来源:Anthropic = 厂商自家发布材料;AA = Artificial Analysis(独立测试)。对于多个经典 benchmark,Anthropic 没有发布过 Opus 5 的数字——这些行如实写「未确认」,不猜测。
| Claude Fable 5 | Claude Opus 5 | 来源 | |
|---|---|---|---|
| SWE-Bench Pro | 80.3% | 未确认(截至 2026 年 8 月 4 日) | |
| FrontierCode Diamond | 29.3% | 未确认(截至 2026 年 8 月 4 日) | |
| Frontier-Bench v0.1 | 33.7% | 43.3% | |
| CursorBench 3.2 | 保持公开最高分 | 距 Fable 5 峰值 0.5% 以内,每任务成本约一半 | |
| ARC-AGI 3 | 未测试 | 约为次优模型的 3 倍 | |
| Zapier AutomationBench | 未发布 | 通过率约为次优模型的 1.5 倍 | |
| OSWorld 2.0 / OSWorld-Verified | 85.0% | 以约 1/3 成本超过 Fable 5 的最好成绩 | |
| GDPval-AA | 1932 | 1861 | |
| AA-Briefcase | 未发布 | 1720 | |
| Humanity's Last Exam | 53% | 53% | |
| Terminal-Bench v2.1 | 未发布 | 89% | |
| AA 智能指数 | 60 | 61 |
Anthropic:Opus 5 发布公告(2026 年 7 月 24 日)与 Fable 5 发布表(2026 年 6 月 9 日)。AA:Artificial Analysis 关于 Opus 5 的文章(2026 年 7 月 24 日)。Fable 5 的 SWE-Bench Pro 80.3% 与 FrontierCode 29.3% 仍是 Anthropic 为广泛可用模型发布过的最高数字——截至 2026 年 8 月 4 日,Opus 5 在这两项上均未发布成绩。 GDPval-AA 的数字来自不同版本的 harness(Anthropic 6 月 9 日发布表对 AA 的 v2),不可直接比较。
决策矩阵:如果你……就用……
四类升 Fable 5 的场景、默认 Opus 5 的场景,以及预算场景。其余一切从 Opus 5 开始。
你运行多小时的自主 agent
长链路 agent(30-90 分钟以上、大量工具调用、文件记忆)正是 Fable 5 的定位——Anthropic 称其为「长运行 agent」模型。选 Fable 5。
你做安全关键的编码
Mythos 级安全工作(抗漏洞代码、防御性工具)是 Fable 5 的地盘——Opus 5 自己在这方面「仍落后于 Mythos 5」。选 Fable 5(或 Mythos 变体)。
你在一个上下文中分析整个仓库
需要塞满 1M 窗口的全库读取——两个模型都有 1M 上下文,但 Fable 5 在最难编码任务上的峰值(SWE-Bench Pro 80.3%)是已发布的最高点。选 Fable 5。
合规要求留存数据,或 ZDR 不可用
你的数据政策要求留存日志,或无法获得 ZDR。Fable 5 强制的 30 天留存正是某些政策要求的日志留存——当零数据留存无法签订时,Fable 5 也不存在需要谈判的留存缺口。相比之下 Opus 5 完全没有留存,无法满足要求留存的政策。选 Fable 5。
你正在开启一个新项目
复杂 agentic 编码和企业工作——Anthropic 官方建议从 Opus 5 开始,而且它已经是 Max 的默认模型。选 Opus 5(high 档)。
你在规模化地优化预算
高吞吐编码与工具调用,价格只有 Fable 5 列表价的 1/5——Sonnet 5($2/$10 促销价,至 2026 年 8 月 31 日)能覆盖大多数日常任务。选 Sonnet 5。
决策指南截至 2026 年 8 月 4 日,基于 Anthropic 官方指引、已发布 benchmark 与 Anthropic 的套餐文档。你自己的评测永远比任何默认建议可靠。
编码决策:各解什么题、各花多少钱
编码数字,加上真正决定取舍的算术:每解决一个任务的成本,而不是通过率。
Agentic 编码 benchmark
SWE-Bench Pro:Fable 5 的 80.3% 是已发布的最高分——Opus 5 没有发布成绩(未确认)。FrontierCode Diamond:Fable 5 为 29.3%;Opus 5 未发布(未确认)。Anthropic 为 Opus 5 主打的最新 agentic 编码测试 Frontier-Bench v0.1:Opus 5 以 43.3% 胜过 Fable 5 的 33.7%。
真实使用中的表现
Artificial Analysis 测出 Opus 5 智能指数 61 对 Fable 5 的 60(max 档),Terminal-Bench v2.1 上 Opus 5 为 89%(Fable 5 无发布数字)。Lovable 报告其最难的 agentic 编码内部评测相对 Opus 4.7 提升 22%。Fable 5 的 80.3% 使用的是 Anthropic 自家脚手架——分数只能在相同 harness 内比较。
每解决一个任务的成本
max 档下,Artificial Analysis 测出 Opus 5 每任务约 $2.03,Fable 5 约 $2.75——省 26%。算例:100 个编码任务,high 档,每个约 1 万输入 tokens(50% 缓存命中)+ 8 千输出。Fable 5 ≈ $45.50;Opus 5 ≈ $22.75。就算 Fable 5 解题率高 2%,也只是多解 2 个;每月 1 万个任务时,这个差价足够养一个团队。
Safeguard 兜底:在 Claude.ai、Claude Code 和 Claude Cowork 上,被 Fable 5 分类器拦截的请求会回退到 Opus 4.8——按 Opus 4.8 价格计费。Opus 5 的网络分类器介入频率比 Fable 5 低约 85%。
一个月真实负载要花多少钱
三种代表性负载按列表价估算,未叠加批量与缓存折扣——真实数字请用成本计算器。
Agentic 编码(每月 1,000 任务)
Fable 5 ≈ $1,720 · Opus 5 ≈ $860
1M 上下文分析(每月 50 次)
Fable 5 ≈ $470 · Opus 5 ≈ $235
高吞吐客服(每月 20 万请求)
Fable 5 ≈ $12,750 · Opus 5 ≈ $6,375 · Sonnet 5 ≈ $2,550(促销价)
按 API 列表价估算:输入 50% 缓存命中,agentic 运行输出 +30%。你的真实用量请用计算器精确计算。由于 Opus 5 每个答案消耗的 tokens 可能多于 Fable 5,实际差距往往小于列表价的 2 倍——永远不要只凭列表价做预算。
决定企业合同成败的差异
Fable 5 出于安全监控有强制 30 天留存窗口,零数据留存(ZDR)协议对它不适用。Opus 5 常规访问没有数据留存要求——Anthropic 发言人在发布会上主动提起这一点,专门针对有硬性 ZDR 需求的客户。如果合规审查曾在你们公司拦下 Fable 5,这个障碍在 Opus 5 上不存在。
Fable 5 的独有角度:benchmark 看不见的分流机制
有三件事把两个模型分开,而任何 benchmark 表都不会显示。
分类器驱动的请求分流
Fable 5 的安全分类器会把被标记的请求分流到 Opus 4.8(Claude.ai、Claude Code、Claude Cowork)或 Opus 5(7 月 24 日起的生物学请求)。Opus 5 的网络分类器介入频率低约 85%。
30 天留存是强制的
Fable 5 出于安全监控要求 30 天留存,且被排除在 ZDR 协议之外。Opus 5 常规访问没有留存要求。
真正的天花板是 Mythos 5
网络安全与生物学的最高已发布分数属于 Mythos 5(仅限受邀,通过 Project Glasswing)。Fable 5 是广泛可用的那一档;Opus 5 在这些领域「仍落后于 Mythos 5」。
Fable 5 仍然值得选的四种情况
溢价仍然值得付出的四类场景——即决策矩阵里的升级场景。
长链路自主运行就是任务本身
带文件记忆的多小时 agent 运行正是 Fable 5 的定位,它在这类场景的公开运行记录也更长。Anthropic 称其为「长运行 agent」模型。
你需要 Mythos 级的安全工作
在网络安全与生物学上,Opus 5 自己也承认仍落后于 Mythos 5——而 Fable 5 是该家族广泛可用的层级。如果你的负载是安全关键编码,这根本不是价格问题。
你在 Max 且还在每周 50% 池内
Max 与 Team Premium 每周额度的 50% 以内包含 Fable 5。在池内边际成本为零——算法完全不同。
你的 harness 已调好,账单也能接受
迁移只是一行改动,但并非免费——提示缓存、effort 档位、评测都要重来。如果现状稳定、账单可接受,就没有紧迫性。
如何切换
两个模型的请求格式相同,大多数代码库里只需改一行。
API——改模型 ID
把 claude-fable-5 换成 claude-opus-5。effort 参数(两者默认都是 high)、不存在的 temperature/top_p/top_k、自适应思考全部原样沿用。Opus 5 还新增了 API 自动兜底路由。
Claude Code——/model opus
在会话里运行 /model opus,或设置 ANTHROPIC_MODEL=claude-opus-5。在 Max 上 Opus 5 本来就是默认——你可能从 7 月 24 日起就一直在用它。
Claude 应用——Max 上什么都不用做
发布当天 Opus 5 就成为 Claude Max 的默认模型、Claude Pro 的最强模型,订阅价格不变。