集群更新很快——价格与模型会变
Qwen 3.8 Max 已宣布但尚未发布,且各家厂商都按自己的节奏更新定价与权重。以下数据截至 2026 年 8 月、源自厂商页面;请查看替代方案页获取最新情况。
查看最新的替代方案页模型对比 · 国产集群
Fable 5 对比国产模型
Claude Fable 5 对比 Qwen 3.8 Max、Kimi K3、GLM 5.2、DeepSeek V4 Pro 与 DeepSeek V4 Flash——价格、编码基准、开源权重与出口管制现实,数据截至 2026 年 8 月。
一句话总结
对大多数主流工作而言,Claude Fable 5 仍是参考标准,但国产集群在价格和开源权重上竞争激烈。Fable 5 在智能体编码与安全/留存保证上胜出;DeepSeek、GLM 和 Qwen 在成本与自托管上胜出;Kimi K3 是最接近的正面对决。出口管制时机是真正的差异化因素——详见下文。
主对比矩阵
每百万 token 的价格(输入 / 输出)、上下文窗口、开源状态与适用场景,截至 2026 年 8 月。Fable 5 价格来自 Anthropic 官方定价;竞品价格为厂商数据并按来源标注。
| 模型 | 输入 / $1M | 输出 / $1M | 上下文 | 开源 | 适用场景 | 来源 |
|---|---|---|---|---|---|---|
| Claude Fable 5 | $10.00 | $50.00 | 1M | Closed API | 智能体编码 + 安全 | Anthropic 官方发布 |
| Qwen 3.8 Max | ≈$2.00 | ≈$6.00 | 1M | Announced, not released | 开源权重(已宣布) | 厂商发布 |
| Kimi K3 | $3.00 | $15.00 | 1M | Open weights | 最接近的正面质量 | 厂商发布 |
| GLM 5.2 | ~$1.40 | ~$4.40 | 1M | Open weights (MIT) | 开源权重、编码强 | 厂商发布 |
| DeepSeek V4 Pro | $0.435 | $0.87 | 1M | Open weights | 最便宜的开源智能体 | 厂商发布 |
| DeepSeek V4 Flash | $0.14 | $0.28 | 1M | Open weights (MIT) | 最低成本的高吞吐 | 厂商发布 |
价格为美元、每百万 token,截至 2026 年 8 月。Fable 5 为 Anthropic 官方发布;竞品价格为各厂商发布(标注为「厂商」)——Qwen 3.8 Max 为已宣布的目标定价,尚未在已发布模型上确认。
编码基准
仅列出已发布的数据。每个单元格都标注来源——「厂商」表示厂商自报、未经独立确认;「未发布」表示厂商未公布数字。
| 模型 | Claude Fable 5 | Qwen 3.8 Max | Kimi K3 | GLM 5.2 | DeepSeek V4 Pro | DeepSeek V4 Flash |
|---|---|---|---|---|---|---|
| SWE-bench Pro | 80.3% | table.val_vendor | table.val_vendor | 62.1% | 55.4% | table.val_not_published |
| FrontierCode | 29.3% | table.val_none | table.val_none | table.val_none | table.val_none | table.val_none |
Anthropic 官方发布:Fable 5 的 SWE-bench Pro 80.3%、FrontierCode 29.3%。GLM 5.2(SWE-bench Pro 62.1%)与 DeepSeek V4 Pro(55.4%)为厂商自报、未经独立确认。Qwen 与 Kimi 未公布可比数字——标注为「未确认」而非猜测。
各厂商的基准不可直接比较——各自运行自己的测试框架与提示集合。跨模型差异应视为方向性参考,而非精确值。
你该选哪个?
五个决策要点,各自对应最合适的模型。
你需要自托管或开源权重
GLM 5.2(MIT)与 DeepSeek V4 系列是强推荐——权重可下载、可在自有硬件上运行。Qwen 3.8 Max 承诺同样能力但尚未发布。
你高吞吐且对成本敏感
DeepSeek V4 Flash(约 $0.14/$0.28)与 V4 Pro($0.435/$0.87)以极大优势最便宜。Fable 5 为 $10/$50——在质量与保证重要时物有所值,不适合批量吞吐。
你想要最接近的质量挑战者
Kimi K3 在通用编码质量上最接近 Fable 5,约 $3/$15。在最难的智能体任务上仍落后,但日常编码差距很小。
你需要智能体编码与安全
Fable 5 在智能体编码上领先(SWE-bench Pro 80.3%),并以安全分类器、留存保证与 Anthropic 企业支持为后盾。这是该模型最明确的优势。
留存与出口管制对你很重要
Fable 5 强制 30 天留存、不支持 ZDR,且可在出口管制下的国产模型渠道之外获取,是受监管企业更稳妥的合规选择。详见出口管制章节。
这些是决策规则而非排名——正确的模型取决于你的工作负载、数据与合规姿态。
出口管制与合规
值得拥有的差异化因素:美国出口管制规则与数据留存政策塑造真实的部署选择。
美国出口管制限制影响哪些先进国产模型可用、以及以何种条件可用。截至 2026 年 8 月,整个集群的获取与授权随监管时间表变化——请将可用性视为变动目标,在投入前核实。
Fable 5 强制 30 天数据留存且不支持零数据留存(no-ZDR),这是刻意的安全取舍。承诺零留存的模型未必带有同样的保证——如果你的数据敏感,这是真实的差异。
中国大陆访问是另一个考量:国产厂商通常直接服务大陆用户,而 Anthropic 的 API 在大陆的提供方式不同。请根据你的用户与数据实际所在地来选择。
估算真实成本
头条 token 价格掩盖了真实工作负载成本——分词器膨胀、缓存、努力程度与输出量都会改变数字。在选购前用成本计算器估算你的实际用量。
成本计算器