请与 Opus 5 对比一起阅读
自 2026 年 7 月 24 日 Opus 5 发布后,多数工作的默认推荐已变为半价的 Opus 5。本页(Fable 5 对比 GPT-5.5)对它所比较的两个模型仍然成立——但未绑定 OpenAI 的团队,在定默认之前请先看 Opus 5 对比。
Fable 5 对比 Opus 52026 年 8 月更新
Claude Fable 5 对比 GPT-5.5
Fable 5 在每一项已公布的 agent 编码基准上得分都高于 GPT-5.5,上下文窗口是其 2.5 倍,标价却约为其两倍。以下是有来源的对比和按任务的选择建议。
简而言之
Fable 5 在每一项已公布的编码与 agent 基准上都领先 GPT-5.5——SWE-bench Pro 80.3% 对 58.6%、FrontierCode 29.3% 对 5.7%——上下文是其 2.5 倍(1M 对 400K),但价格更高($10/$50 对 $5/$30)。GPT-5.5 更便宜,且在 OpenAI 生态内很强,但在 agent 编码和长上下文上落后。编码与长上下文选 Fable 5;看价格或绑定 OpenAI 生态选 GPT-5.5。
规格与价格并排对比
Fable 5 数据来自 src/lib/model-pricing.ts(2026 年 8 月 4 日对照 Anthropic 定价文档核对)。GPT-5.5 为 OpenAI 截至 2026 年 8 月公布的标价。
| Claude Fable 5 | GPT-5.5 | |
|---|---|---|
| 价格(输入/输出,每百万 token) | $10 / $50 | $5 / $30 |
| 上下文窗口 | 1M | 400K |
| 最大输出 | 128K | 未确认(截至 2026 年 8 月) |
| 数据保留 | 30 天,强制——不适用 ZDR 协议 | OpenAI 标准企业保留姿态 |
基准:Fable 5 领先之处
每一行都标注来源:Anthropic(Fable 5)与 OpenAI(GPT-5.5)均为厂商自测、在各自选择的设置下跑出的结果——请作为方向性参考,且只在同一评测框架内比较。
| Claude Fable 5 | GPT-5.5 | 来源 | |
|---|---|---|---|
| SWE-bench Pro(agent 编码) | 80.3% | 58.6% | |
| FrontierCode(Diamond) | 29.3% | 5.7% | |
| GDPval(知识工作) | 1932 | 1769 | |
| OSWorld(计算机使用) | 85.0% | 78.7% |
来源:Anthropic 的 Fable 5 发布表(2026 年 6 月 9 日)与 OpenAI 已公布的 GPT-5.5 成绩,截至 2026 年 8 月。跨厂商基准由厂商在各自设置下自行测评;截至本文完稿尚无对每项分数的独立复现。
决策指南:哪种模型,用于哪种工作
基于公布数据与两家厂商产品定位的五条决策行。
你在做 agent / 最难的编码
Fable 5 在每一项已公布数据上都领先——SWE-bench Pro 80.3% 对 58.6%,FrontierCode 29.3% 对 5.7%,后者 GPT-5.5 基本无法参与。选 Fable 5。
你需要 1M 上下文 / 全仓库工作
Fable 5 的 1M 窗口对 GPT-5.5 的 400K,对整仓库读取和长上下文分析是实打实的差异。若完整仓库必须放进一个上下文里,选 Fable 5。
你在规模化地优化成本
GPT-5.5 的 $5/$30 约为 Fable 5 的 $10/$50 标价的一半。对两者都能达质量线的大流量生产,价格说了算。选 GPT-5.5。
你绑定了 OpenAI 生态
Structured outputs、Assistants 工具链和既有 GPT 集成的切换成本,没有基准能抵消。若你已建在 OpenAI 上,选 GPT-5.5。
你的合规政策要求数据保留
Fable 5 强制的 30 天保留,正是某些政策要求的日志保留,且不适用零数据保留协议。GPT-5.5 的隐私姿态不同。选 Fable 5。
决策指南截至 2026 年 8 月,基于公布基准与两家厂商的产品定位。你在自己负载上的评测胜过任何默认建议。
数据保留的差异
Fable 5 为安全监控要求强制的 30 天保留窗口,且不适用零数据保留(ZDR)协议。GPT-5.5 遵循 OpenAI 的标准企业保留姿态。对有硬性数据保留或 ZDR 要求的团队,这可能是决定性因素——而不是基准表。