集群更新很快——价格与模型会变

Qwen 3.8 Max 已宣布但尚未发布,且各家厂商都按自己的节奏更新定价与权重。以下数据截至 2026 年 8 月、源自厂商页面;请查看替代方案页获取最新情况。

查看最新的替代方案页

模型对比 · 国产集群

Fable 5 对比国产模型

Claude Fable 5 对比 Qwen 3.8 Max、Kimi K3、GLM 5.2、DeepSeek V4 Pro 与 DeepSeek V4 Flash——价格、编码基准、开源权重与出口管制现实,数据截至 2026 年 8 月。

一句话总结

对大多数主流工作而言,Claude Fable 5 仍是参考标准,但国产集群在价格和开源权重上竞争激烈。Fable 5 在智能体编码与安全/留存保证上胜出;DeepSeek、GLM 和 Qwen 在成本与自托管上胜出;Kimi K3 是最接近的正面对决。出口管制时机是真正的差异化因素——详见下文。

主对比矩阵

每百万 token 的价格(输入 / 输出)、上下文窗口、开源状态与适用场景,截至 2026 年 8 月。Fable 5 价格来自 Anthropic 官方定价;竞品价格为厂商数据并按来源标注。

模型输入 / $1M输出 / $1M上下文开源适用场景来源
Claude Fable 5$10.00$50.001MClosed API智能体编码 + 安全Anthropic 官方发布
Qwen 3.8 Max≈$2.00≈$6.001MAnnounced, not released开源权重(已宣布)厂商发布
Kimi K3$3.00$15.001MOpen weights最接近的正面质量厂商发布
GLM 5.2~$1.40~$4.401MOpen weights (MIT)开源权重、编码强厂商发布
DeepSeek V4 Pro$0.435$0.871MOpen weights最便宜的开源智能体厂商发布
DeepSeek V4 Flash$0.14$0.281MOpen weights (MIT)最低成本的高吞吐厂商发布

价格为美元、每百万 token,截至 2026 年 8 月。Fable 5 为 Anthropic 官方发布;竞品价格为各厂商发布(标注为「厂商」)——Qwen 3.8 Max 为已宣布的目标定价,尚未在已发布模型上确认。

编码基准

仅列出已发布的数据。每个单元格都标注来源——「厂商」表示厂商自报、未经独立确认;「未发布」表示厂商未公布数字。

模型Claude Fable 5Qwen 3.8 MaxKimi K3GLM 5.2DeepSeek V4 ProDeepSeek V4 Flash
SWE-bench Pro80.3%table.val_vendortable.val_vendor62.1%55.4%table.val_not_published
FrontierCode29.3%table.val_nonetable.val_nonetable.val_nonetable.val_nonetable.val_none

Anthropic 官方发布:Fable 5 的 SWE-bench Pro 80.3%、FrontierCode 29.3%。GLM 5.2(SWE-bench Pro 62.1%)与 DeepSeek V4 Pro(55.4%)为厂商自报、未经独立确认。Qwen 与 Kimi 未公布可比数字——标注为「未确认」而非猜测。

各厂商的基准不可直接比较——各自运行自己的测试框架与提示集合。跨模型差异应视为方向性参考,而非精确值。

你该选哪个?

五个决策要点,各自对应最合适的模型。

  • 你需要自托管或开源权重

    GLM 5.2(MIT)与 DeepSeek V4 系列是强推荐——权重可下载、可在自有硬件上运行。Qwen 3.8 Max 承诺同样能力但尚未发布。

  • 你高吞吐且对成本敏感

    DeepSeek V4 Flash(约 $0.14/$0.28)与 V4 Pro($0.435/$0.87)以极大优势最便宜。Fable 5 为 $10/$50——在质量与保证重要时物有所值,不适合批量吞吐。

  • 你想要最接近的质量挑战者

    Kimi K3 在通用编码质量上最接近 Fable 5,约 $3/$15。在最难的智能体任务上仍落后,但日常编码差距很小。

  • 你需要智能体编码与安全

    Fable 5 在智能体编码上领先(SWE-bench Pro 80.3%),并以安全分类器、留存保证与 Anthropic 企业支持为后盾。这是该模型最明确的优势。

  • 留存与出口管制对你很重要

    Fable 5 强制 30 天留存、不支持 ZDR,且可在出口管制下的国产模型渠道之外获取,是受监管企业更稳妥的合规选择。详见出口管制章节。

这些是决策规则而非排名——正确的模型取决于你的工作负载、数据与合规姿态。

出口管制与合规

值得拥有的差异化因素:美国出口管制规则与数据留存政策塑造真实的部署选择。

美国出口管制限制影响哪些先进国产模型可用、以及以何种条件可用。截至 2026 年 8 月,整个集群的获取与授权随监管时间表变化——请将可用性视为变动目标,在投入前核实。

Fable 5 强制 30 天数据留存且不支持零数据留存(no-ZDR),这是刻意的安全取舍。承诺零留存的模型未必带有同样的保证——如果你的数据敏感,这是真实的差异。

中国大陆访问是另一个考量:国产厂商通常直接服务大陆用户,而 Anthropic 的 API 在大陆的提供方式不同。请根据你的用户与数据实际所在地来选择。

估算真实成本

头条 token 价格掩盖了真实工作负载成本——分词器膨胀、缓存、努力程度与输出量都会改变数字。在选购前用成本计算器估算你的实际用量。

成本计算器

哪个模型匹配你的工作负载?

在完整排行榜上做全面对比,或先为你的具体工作量定价再做决定。

常见问题