Fable 5 对比 Qwen 3.8 Max:阿里 2.4 万亿参数旗舰,值得换吗?
Qwen 3.8 Max 于 2026 年 8 月 3 日发布,是阿里迄今最大的 2.4 万亿参数旗舰模型。和 Claude Fable 5 比价格、编码基准、开源权重和国内接入,到底怎么选。
Qwen 3.8 Max 是阿里对标 Claude Fable 5 的答案——2.4 万亿参数的多模态旗舰,2026 年 8 月 3 日发布,价格约为 Fable 5 的五分之一,开源权重承诺发布后一周放出。对价格敏感、以及需要在境内直接调用大模型的团队来说,这是今年出现的分量最重的 Fable 5 替代品。但论最难的 Agentic 编码,Fable 5 仍是守擂方——只不过「仅次于 Fable 5」(阿里自己的说法)这次值得认真对待了。
Fable 5 对比 Qwen 3.8 Max:简短回答
Qwen 3.8 Max 赢在价格、开放性和境内接入;Claude Fable 5 赢在已被验证的 Agentic 编码和 Anthropic 生态。 阿里称其 2.4 万亿参数 MoE 旗舰在 LMArena 上仅次于 Anthropic 的 Claude 系列,并在智能体电脑操作上超过 Fable 5——但发布时既没有模型卡也没有基准表,这些数字都是厂商自报,未独立验证。Fable 5 的 SWE-Bench Pro 80.3% 仍是已公开的 Agentic 编码最高分,价格 $10/$50 每百万 token;Qwen 3.8 Max 国内 ¥12/¥36(国际约 $2/$6)。日常编码、推理和多模态工作,Qwen 3.8 Max 便宜得多;最难的那 20% Agentic 任务,Fable 5(或半价的 Claude Opus 5)仍是更稳的选择。
Qwen 3.8 Max 的最新信息(截至 2026 年 8 月 4 日)
- 2026 年 8 月 3 日发布,是 7 月 19 日 Qwen3.8-Max-Preview 的正式版(GA),同期发布较小的 Qwen 3.8-27B。
- 总参数 2.4 万亿,稀疏 MoE 架构,单次推理激活约 950 亿参数——据阿里称是开源大模型家族中规模最大(仅次于月之暗面 Kimi K3 的 2.8 万亿)。
- 1M token 上下文窗口,多模态输入(文本、图像、视频)。
- 开源权重承诺「下周」发布,走阿里云百炼(Model Studio)。截至 2026-08-04,仓库、许可证、模型卡均未放出——未确认。
- 价格:国内 ¥12 / ¥36 每百万输入/输出 token;国际约 $2 / $6(约为 Claude Opus 5 的 40% / 24%)。缓存命中输入 ¥1.5。
速览
| 规格 | Qwen 3.8 Max | Claude Fable 5 |
|---|---|---|
| 厂商 | 阿里(通义千问) | Anthropic |
| 发布时间 | 2026-08-03(GA;预览版 7-19) | 2026-06-09(6-12 至 7-1 因美国出口管制停用) |
| 参数量 | 2.4 万亿,稀疏 MoE(激活约 950 亿) | 未公布 |
| 上下文 | 1M tokens | 1M tokens |
| 最大输出 | 未公布 | 128K tokens |
| 模态 | 文本、图像、视频输入 | 文本、图像、PDF 输入 |
| API 价格(每百万) | 国内 ¥12 / ¥36;国际约 $2 / $6 | $10 / $50 |
| 开放权重 | 承诺「下周」开源——尚未放出 | 无(Anthropic 不发布权重) |
| 数据保留 | 未公布强制安全保留(未确认) | 强制 30 天保留,零保留(ZDR)协议不适用 |
| 国内接入 | 阿里云直连、人民币计费 | 无国内节点,API 由境外提供 |
基准对比:厂商自报 vs 独立验证
这里必须逐字看清楚。Qwen 3.8 Max 发布时没有模型卡、没有基准表——发布会数字全部出自阿里自家评测,且对比竞品时用的是各家自己的编码工具链(Anthropic 用 Claude Code、OpenAI 用 Codex),测评方法已被独立分析师质疑。Fable 5 的公开成绩同样出自 Anthropic 自报。两边都没有被完整独立审计过。
| 基准 | Qwen 3.8 Max | Claude Fable 5 | 来源与可信度 |
|---|---|---|---|
| SWE-Bench Pro(Agentic 编码) | 发布时未公布 | 80.3% | Fable 5 为 Anthropic 公布;Qwen 未确认 |
| OSWorld-Verified(电脑操作) | 86.1,自称主流模型第一 | 未公布 | 阿里自报,未独立验证 |
| PaperBench(编码智能体) | 93.0(较上代 +28.2) | 未公布 | 阿里自报,未独立验证 |
| GPQA Diamond(科学推理) | 92.6 | 未公布 | 阿里自报,未独立验证 |
| Frontend Code Arena | 1668(全球第 4) | 阿里称不如 Qwen(「Fable 5 High」) | 第三方榜单;阿里的 Fable 说法未验证 |
| LMArena | 文本第 5、视觉第 2 | 「仅次于 Claude 系列」(阿里口径) | 第三方榜单 + 厂商口径 |
引用之前,还有两点要留神:
- Fable 5 的数字同样要打折看。 它的公开成绩背后是安全防护兜底机制:触发分类器时请求会静默转给较弱模型(网络安全类转 Opus 4.8、生物类转 Opus 5),比例低于 5% 的会话。这类基准并不总是 Fable 5 本人答的。
- 阿里的旗舰宣传存在验证缺口。 发布会宣传了一个 16 天完全自主的编码项目(「从空文件夹出发、全程无需人干预」做出开源 CLI),分析师当场追问:人类介入了几次?产出经得起代码评审吗?对比参考,本站对 Fable 5 的真实世界基准 有详细记录。
成本算例:差距才是重点
小团队一个月做 Agentic 编码的典型用量:1000 万输入 + 200 万输出 token。
| Claude Fable 5 | Qwen 3.8 Max(国际) | Qwen 3.8 Max(国内) | |
|---|---|---|---|
| 输入 | 10 × $10 = $100 | 10 × $2 = $20 | 10 × ¥12 = ¥120 |
| 输出 | 2 × $50 = $100 | 2 × $6 = $12 | 2 × ¥36 = ¥72 |
| 合计 | $200 | $32(约省 6.3 倍) | ¥192(约 $27) |
提示词缓存会进一步拉开差距——Qwen 缓存命中输入 ¥1.5/M,Fable 5 缓存读 $1/M。Fable 5 有一项非 token 的优势:自 2026 年 7 月 20 日起永久包含在 Claude Max 和 Team Premium 每周额度的一半以内,订阅用户未必按 API 价计费。如果按量付费,先用我们的成本计算器算你自己的数字。
决策矩阵
- 在国内做开发,需要直接可用、人民币计费、没有出口管制风险的前沿模型 → Qwen 3.8 Max。 Fable 5 曾因美国出口管制全球停用 19 天,且 Anthropic API 在境外提供服务——数据出境这个问题,不是省几个钱能解决的。
- 预算紧,工作以日常编码、数学、多模态为主 → Qwen 3.8 Max,刊例价约为 Fable 5 的五分之一。给最难的那 20% 留一条升级路径。
- 需要自托管、可审计的推理 → 等 Qwen 3.8 Max 权重落地后再定。 截至 2026-08-04 发布日期和许可证都未确认,别在官方渠道发布前把架构押上去。
- 做最难的 Agentic 编码、长链路自主任务,或基于 Claude Code / Model Fusion 开发 → Fable 5;想要无保留条款的 Anthropic 产品线,则选 $5/$25 的 Claude Opus 5(详见 Fable 5 vs Opus 5)。
- 数据有明确地域要求 → 按数据驻留做决定,别按价格:Fable 5 意味着强制 30 天保留、ZDR 不可豁免;阿里云国内节点则把处理留在境内、但受国内数据法规约束。签约前确认具体机房地域和条款。
- 拿不定主意 → 准备一份通用的提示词,两边各自小流量试跑,再对照 Fable 5 替代方案指南 全面比较。
诚实的结论
Qwen 3.8 Max 是今年第一个在价格、规模和 Agentic 野心上真正站进 Fable 5 梯队的挑战者,也是国内团队唯一不用绕出口管制和数据出境就能用的选择。但「站进梯队」的前提要打问号:模型发布时没有模型卡,头条数字全是厂商自报,开源权重的日期和许可也还没影。Fable 5 经得起验证的 80.3% SWE-Bench Pro 和成熟的 Agentic 运行时,仍是衡量整个赛道的尺子。先在两边各跑一个小流量,让你的「每解决一个任务的实际成本」——而不是发布会 PPT——来做决定。
独立分析——所有替代方案见我们的 Fable 5 替代方案指南。