Astra 数据为 OpenAI 官方口径,截至 2026年9月
GPT-6 Astra 数据来自 OpenAI 2026年9月3日官宣及模型文档(厂商自报,尚缺第三方复核)。Fable 5.1 价格与规格为 Anthropic 公开定价,本站于 2026-09-02 核对。
查看早前的 Fable 5 对比 GPT-5.5GPT-6 Astra 对比 Fable 5.1 · 2026年9月
GPT-6 Astra 对比 Claude Fable 5.1
OpenAI 的 computer-use 旗舰对上 Anthropic 的编程旗舰——标价完全相同,计费行为却大不一样。规格、官方跑分与选型建议,一页看懂。
TL;DR(先看结论)
两款旗舰标价同为 $10/$50 每百万 tokens(2026年9月数据)。GPT-6 Astra 在 OpenAI 自家的 computer-use 与 agent 跑分上领先(Terminal-Bench Science 64.6% 对 52.6%,官方自测),上下文窗口 1.05M——但输入超过 272K tokens 后整单按 2 倍输入 / 1.5 倍输出计费。Claude Fable 5.1 任意上下文长度价格不变,并握有已公布的最强编程成绩(SWE-bench Verified 87.7%,Astra 未公布该项成绩)。
规格速览
Astra 为 OpenAI 2026年9月的牌价;Fable 5.1 为 Anthropic 2026年9月2日发布的公开定价。
| 规格 | GPT-6 Astra | Claude Fable 5.1 |
|---|---|---|
| 模型 ID | gpt-6-astra | claude-fable-5-1-20260902 |
| 发布时间 | 2026年9月3日 | 2026年9月2日 |
| 输入价格(每百万 tokens) | $10.00 | $10.00 |
| 输出价格(每百万 tokens) | $50.00 | $50.00 |
| 长上下文计费 | 输入超 272K 后按 2 倍输入 / 1.5 倍输出 | 任意上下文长度统一费率 |
| 上下文窗口 | 1.05M | 1M |
| 最大输出 | 128K | 128K |
| 电脑操作(Computer use) | 原生主打(computer-use 优先设计) | 较强(API computer-use 工具链) |
| 扩展思考 | 推理档位含 xhigh 与 max | 自适应预算 + 推理档位 |
| 数据保留 | 符合条件的 API 客户可用零保留(ZDR) | 强制保留 30 天 |
两家标价一模一样,差别在规模上量之后:Astra 单次请求输入超过 272K tokens,整单按 2 倍输入 / 1.5 倍输出计费;Fable 5.1 无论上下文多长,价格始终是 $10/$50。
跑分对比——多为厂商自报
OpenAI 在 Terminal-Bench 上同台测了两家模型;SWE-bench 与 OSWorld 两行来自各自厂商,口径不同不能直接比。
| 规格 | GPT-6 Astra | Claude Fable 5.1 |
|---|---|---|
| SWE-bench Verified | 未公布 | 87.7% |
| Terminal-Bench 4.0 | 57.9% | 55.8% |
| Terminal-Bench Science 0.1 | 64.6% | 52.6% |
| BenchCAD | 95.9% | 84.3% |
| OSWorld(见注释) | 72.6% | 89.6% |
数据来源:Terminal-Bench 4.0、Terminal-Bench Science 0.1 与 BenchCAD 为 OpenAI 自家 harness 测得(2026年9月)。Fable 5.1 的 SWE-bench Verified 87.7% 为 Anthropic 官方口径(2026年9月2日发布);OpenAI 未公布 Astra 的 SWE-bench Verified 成绩。OSWorld 一行两边用的不是同一版基准(Anthropic 报 Fable 5.1 为 89.6%,OpenAI 报 Astra 在 OSWorld V2-Offline 为 72.6%),只能作方向性参考。第三方(MindStudio)的结论是 Astra 并非全面领先。
到底怎么选
同一个价,两台不同的机器。按工作负载选。
你需要自主电脑操作(computer-use)智能体
Astra 是 OpenAI 为 computer-use 而生的旗舰:内置 computer-use、shell 与浏览器工具,Agents' Last Exam 59.3%(官方自测)。Fable 5.1 通过 API computer-use 工具链也能打,但 Astra 是专门为此设计的。
你要的是经过验证的编程能力
Fable 5.1 的 SWE-bench Verified 87.7% 是两者中已公布的最强编程成绩;OpenAI 未公布 Astra 的 SWE-bench 成绩,其 Terminal-Bench 领先(57.9% 对 55.8%)也出自自家 harness。
你经常一次性吞近百万 tokens 的输入
Astra 的 1.05M 窗口名义上大于 Fable 5.1 的 1M,但输入一旦超过 272K tokens,整单按 2 倍输入 / 1.5 倍输出计费。长文档场景下,Fable 5.1 的统一费率通常总成本更低。
输入低于 272K 时的成本对比
不触发加价时两者成本几乎相同:牌价 $10/$50、缓存命中 $1.00、批量五折。你现有的 token 成本测算可以直接平移——丢进成本计算器跑一遍即可。
你的工作涉及安全研究——或者看起来像
Astra 是 OpenAI 首个达到网络安全 Critical 级的模型:标准权限会拒绝高级漏洞利用类任务,API 安全检查可能中途叫停,相关能力需要 Trusted Access 审批。Fable 5.1 没有对应的门槛。
按牌价算,两者成本几乎可以互换——真正的差异在 272K 加价、computer-use 深度,以及你信谁家的跑分。
用你自己的用量算一笔账
两款模型牌价同为 $10/$50 每百万 tokens——真正起作用的是你的 token 构成、缓存命中率,以及多久跨一次 272K 输入门槛。