请与 Opus 5 对比一起阅读

自 2026 年 7 月 24 日 Opus 5 发布后,多数工作的默认推荐已变为半价的 Opus 5。本页(Fable 5 对比 GPT-5.5)对它所比较的两个模型仍然成立——但未绑定 OpenAI 的团队,在定默认之前请先看 Opus 5 对比。

Fable 5 对比 Opus 5

2026 年 8 月更新

Claude Fable 5 对比 GPT-5.5

Fable 5 在每一项已公布的 agent 编码基准上得分都高于 GPT-5.5,上下文窗口是其 2.5 倍,标价却约为其两倍。以下是有来源的对比和按任务的选择建议。

简而言之

Fable 5 在每一项已公布的编码与 agent 基准上都领先 GPT-5.5——SWE-bench Pro 80.3% 对 58.6%、FrontierCode 29.3% 对 5.7%——上下文是其 2.5 倍(1M 对 400K),但价格更高($10/$50 对 $5/$30)。GPT-5.5 更便宜,且在 OpenAI 生态内很强,但在 agent 编码和长上下文上落后。编码与长上下文选 Fable 5;看价格或绑定 OpenAI 生态选 GPT-5.5。

规格与价格并排对比

Fable 5 数据来自 src/lib/model-pricing.ts(2026 年 8 月 4 日对照 Anthropic 定价文档核对)。GPT-5.5 为 OpenAI 截至 2026 年 8 月公布的标价。

Claude Fable 5GPT-5.5
价格(输入/输出,每百万 token)$10 / $50$5 / $30
上下文窗口1M400K
最大输出128K未确认(截至 2026 年 8 月)
数据保留30 天,强制——不适用 ZDR 协议OpenAI 标准企业保留姿态

基准:Fable 5 领先之处

每一行都标注来源:Anthropic(Fable 5)与 OpenAI(GPT-5.5)均为厂商自测、在各自选择的设置下跑出的结果——请作为方向性参考,且只在同一评测框架内比较。

Claude Fable 5GPT-5.5来源
SWE-bench Pro(agent 编码)80.3%58.6%
FrontierCode(Diamond)29.3%5.7%
GDPval(知识工作)19321769
OSWorld(计算机使用)85.0%78.7%

来源:Anthropic 的 Fable 5 发布表(2026 年 6 月 9 日)与 OpenAI 已公布的 GPT-5.5 成绩,截至 2026 年 8 月。跨厂商基准由厂商在各自设置下自行测评;截至本文完稿尚无对每项分数的独立复现。

决策指南:哪种模型,用于哪种工作

基于公布数据与两家厂商产品定位的五条决策行。

  • 你在做 agent / 最难的编码

    Fable 5 在每一项已公布数据上都领先——SWE-bench Pro 80.3% 对 58.6%,FrontierCode 29.3% 对 5.7%,后者 GPT-5.5 基本无法参与。选 Fable 5。

  • 你需要 1M 上下文 / 全仓库工作

    Fable 5 的 1M 窗口对 GPT-5.5 的 400K,对整仓库读取和长上下文分析是实打实的差异。若完整仓库必须放进一个上下文里,选 Fable 5。

  • 你在规模化地优化成本

    GPT-5.5 的 $5/$30 约为 Fable 5 的 $10/$50 标价的一半。对两者都能达质量线的大流量生产,价格说了算。选 GPT-5.5。

  • 你绑定了 OpenAI 生态

    Structured outputs、Assistants 工具链和既有 GPT 集成的切换成本,没有基准能抵消。若你已建在 OpenAI 上,选 GPT-5.5。

  • 你的合规政策要求数据保留

    Fable 5 强制的 30 天保留,正是某些政策要求的日志保留,且不适用零数据保留协议。GPT-5.5 的隐私姿态不同。选 Fable 5。

决策指南截至 2026 年 8 月,基于公布基准与两家厂商的产品定位。你在自己负载上的评测胜过任何默认建议。

数据保留的差异

Fable 5 为安全监控要求强制的 30 天保留窗口,且不适用零数据保留(ZDR)协议。GPT-5.5 遵循 OpenAI 的标准企业保留姿态。对有硬性数据保留或 ZDR 要求的团队,这可能是决定性因素——而不是基准表。

先算清自己的负载再选择

用计算器按两个价格点跑你的真实月度用量——叠加上缓存与批处理,$10/$50 与 $5/$30 的差距因负载而异。

常见问题