Astra 数据为 OpenAI 官方口径,截至 2026年9月

GPT-6 Astra 数据来自 OpenAI 2026年9月3日官宣及模型文档(厂商自报,尚缺第三方复核)。Fable 5.1 价格与规格为 Anthropic 公开定价,本站于 2026-09-02 核对。

查看早前的 Fable 5 对比 GPT-5.5

GPT-6 Astra 对比 Fable 5.1 · 2026年9月

GPT-6 Astra 对比 Claude Fable 5.1

OpenAI 的 computer-use 旗舰对上 Anthropic 的编程旗舰——标价完全相同,计费行为却大不一样。规格、官方跑分与选型建议,一页看懂。

TL;DR(先看结论)

两款旗舰标价同为 $10/$50 每百万 tokens(2026年9月数据)。GPT-6 Astra 在 OpenAI 自家的 computer-use 与 agent 跑分上领先(Terminal-Bench Science 64.6% 对 52.6%,官方自测),上下文窗口 1.05M——但输入超过 272K tokens 后整单按 2 倍输入 / 1.5 倍输出计费。Claude Fable 5.1 任意上下文长度价格不变,并握有已公布的最强编程成绩(SWE-bench Verified 87.7%,Astra 未公布该项成绩)。

规格速览

Astra 为 OpenAI 2026年9月的牌价;Fable 5.1 为 Anthropic 2026年9月2日发布的公开定价。

规格GPT-6 AstraClaude Fable 5.1
模型 IDgpt-6-astraclaude-fable-5-1-20260902
发布时间2026年9月3日2026年9月2日
输入价格(每百万 tokens)$10.00$10.00
输出价格(每百万 tokens)$50.00$50.00
长上下文计费输入超 272K 后按 2 倍输入 / 1.5 倍输出任意上下文长度统一费率
上下文窗口1.05M1M
最大输出128K128K
电脑操作(Computer use)原生主打(computer-use 优先设计)较强(API computer-use 工具链)
扩展思考推理档位含 xhigh 与 max自适应预算 + 推理档位
数据保留符合条件的 API 客户可用零保留(ZDR)强制保留 30 天

两家标价一模一样,差别在规模上量之后:Astra 单次请求输入超过 272K tokens,整单按 2 倍输入 / 1.5 倍输出计费;Fable 5.1 无论上下文多长,价格始终是 $10/$50。

跑分对比——多为厂商自报

OpenAI 在 Terminal-Bench 上同台测了两家模型;SWE-bench 与 OSWorld 两行来自各自厂商,口径不同不能直接比。

规格GPT-6 AstraClaude Fable 5.1
SWE-bench Verified未公布87.7%
Terminal-Bench 4.057.9%55.8%
Terminal-Bench Science 0.164.6%52.6%
BenchCAD95.9%84.3%
OSWorld(见注释)72.6%89.6%

数据来源:Terminal-Bench 4.0、Terminal-Bench Science 0.1 与 BenchCAD 为 OpenAI 自家 harness 测得(2026年9月)。Fable 5.1 的 SWE-bench Verified 87.7% 为 Anthropic 官方口径(2026年9月2日发布);OpenAI 未公布 Astra 的 SWE-bench Verified 成绩。OSWorld 一行两边用的不是同一版基准(Anthropic 报 Fable 5.1 为 89.6%,OpenAI 报 Astra 在 OSWorld V2-Offline 为 72.6%),只能作方向性参考。第三方(MindStudio)的结论是 Astra 并非全面领先。

到底怎么选

同一个价,两台不同的机器。按工作负载选。

  • 你需要自主电脑操作(computer-use)智能体

    Astra 是 OpenAI 为 computer-use 而生的旗舰:内置 computer-use、shell 与浏览器工具,Agents' Last Exam 59.3%(官方自测)。Fable 5.1 通过 API computer-use 工具链也能打,但 Astra 是专门为此设计的。

  • 你要的是经过验证的编程能力

    Fable 5.1 的 SWE-bench Verified 87.7% 是两者中已公布的最强编程成绩;OpenAI 未公布 Astra 的 SWE-bench 成绩,其 Terminal-Bench 领先(57.9% 对 55.8%)也出自自家 harness。

  • 你经常一次性吞近百万 tokens 的输入

    Astra 的 1.05M 窗口名义上大于 Fable 5.1 的 1M,但输入一旦超过 272K tokens,整单按 2 倍输入 / 1.5 倍输出计费。长文档场景下,Fable 5.1 的统一费率通常总成本更低。

  • 输入低于 272K 时的成本对比

    不触发加价时两者成本几乎相同:牌价 $10/$50、缓存命中 $1.00、批量五折。你现有的 token 成本测算可以直接平移——丢进成本计算器跑一遍即可。

  • 你的工作涉及安全研究——或者看起来像

    Astra 是 OpenAI 首个达到网络安全 Critical 级的模型:标准权限会拒绝高级漏洞利用类任务,API 安全检查可能中途叫停,相关能力需要 Trusted Access 审批。Fable 5.1 没有对应的门槛。

按牌价算,两者成本几乎可以互换——真正的差异在 272K 加价、computer-use 深度,以及你信谁家的跑分。

用你自己的用量算一笔账

两款模型牌价同为 $10/$50 每百万 tokens——真正起作用的是你的 token 构成、缓存命中率,以及多久跨一次 272K 输入门槛。

常见问题