Claude Fable 5 对比 DeepSeek V4 Flash:价格、编码能力,以及何时该切换
DeepSeek V4 Flash 比 Claude Fable 5 便宜约两个数量级(每百万 token $0.14/$0.28 vs $10/$50,截至 2026-08-04)。你会损失多少编码能力、Flash 何时真的够用,以及 Fable 5 独有的限制(30 天留存、安全回退、出口管制)如何改变这笔账。
TL;DR(截至 2026-08-04): DeepSeek V4 Flash 是市面上最便宜的严肃编码模型——每百万 token $0.14 / $0.28,MIT 许可开放权重,100 万上下文——对比 Fable 5 的 $10 / $50(输入约 70 倍、输出约 180 倍价差)。日常与中等复杂度编码它真的够用;前沿 Agentic 编码与长链路自主任务则没有证据它能比肩 Fable 5——其主打 Agentic 数字发布仅四天且未经验证。安全敏感、受监管或合规约束的工作,选 Fable 5(或半价的同门 Opus 5)才是站得住的答案。动手迁移前先用成本计算器算一笔账。
DeepSeek V4 Flash 速览
DeepSeek V4 Flash 是 DeepSeek V4 系列中的「Flash 档」——面向编码助手、对话代理和批处理管线的低成本、高吞吐模型。当前版本为 V4 Flash 0731,2026 年 7 月 31 日发布:与四月预览版同架构,仅重新做后训练,并附带 DSpark 投机解码组件和大幅宣称的 Agentic 能力提升。与 Fable 5 不同,它纯文本(无视觉),权重 MIT 许可——整个模型都能自部署。
在 DeepSeek 自家产品线里,它比 DeepSeek V4 Pro($0.435/$0.87)低一档——Flash 约为 Pro 价格的三分之一。
规格对照
| 规格 | Claude Fable 5 | DeepSeek V4 Flash (0731) |
|---|---|---|
| 厂商 | Anthropic | DeepSeek |
| 定位 | 旗舰级安全优先 Agentic 模型 | 低成本、高吞吐「Flash」档 |
| 输入 / 输出价格(每百万 token) | $10 / $50 | $0.14 / $0.28 |
| 缓存命中输入(每百万 token) | $1 | $0.0028 |
| 上下文窗口 | 100 万 | 100 万 |
| 最大输出 | 128K | 384K |
| 许可 | 闭源,仅 API | MIT 开放权重(可自部署) |
| 参数量 | 未公布 | 约 284B MoE,每 token 激活约 13B |
| 模态 | 文本 + 视觉 | 纯文本 |
| 速度定位 | 前沿推理、长链路自主 | 快速、便宜、高吞吐 |
| 数据留存 | 强制 30 天(ZDR 不豁免) | 由你的政策决定(API)/ 完全自己掌控(自部署) |
价格分别以 DeepSeek API 文档与 Anthropic 公布为准(Fable 5 验证于 2026-07-27,Flash 于 2026-08-04)。注意 DeepSeek 已宣布计划推出高峰时段 2 倍价(北京时间 9:00–12:00 与 14:00–18:00),生效日期尚未公布,截至 2026-08-04 仍为平价。
基准对照:公布了什么、没公布什么
先说尴尬的事实:两个模型几乎不公布重叠的基准,所以不存在干净的正面交锋。
| 基准 | Claude Fable 5 | DeepSeek V4 Flash | 来源 |
|---|---|---|---|
| SWE-Bench Pro | 80.3% | 未公布 | Fable 5:Anthropic 2026-06-09 发布表(官方) |
| SWE-Bench Verified | 未公布 | 79.0% | DeepSeek V4 技术报告(官方自报,未经独立验证) |
| LiveCodeBench | 未公布 | 91.6 | DeepSeek V4 技术报告(官方自报) |
| Codeforces(评级) | 未公布 | 3052 | DeepSeek V4 技术报告(官方自报) |
| Terminal Bench 2.0 | 未公布 | 56.9 | DeepSeek V4 技术报告(官方自报) |
| Terminal Bench 2.1 | 未公布 | 82.7 | DeepSeek 0731 更新日志,2026-07-31(官方自报;内部评测工具,最高 effort) |
| MMLU-Pro | 未公布 | 86.2 | DeepSeek V4 技术报告(官方自报) |
读这些数字之前先记住两点:
- 基准不可比。 SWE-Bench Pro(Fable 5)与 SWE-Bench Verified(Flash)是难度不同的两套测试集。「79.0 vs 80.3」直接对比是错误——测试根本不同。
- 截至 2026-08-04,Flash 一侧没有任何独立验证。 Agentic 数字(Terminal Bench 2.1 82.7、DeepSWE 54.4、NL2Repo 54.2)来自 DeepSeek 自家发布四天的更新日志;更早的 Flash 系列编码分数来自 DeepSeek 技术报告。在第三方跑过之前,都按自报处理。反观 Fable 5 的 SWE-Bench Pro 80.3%,自 6 月 9 日公开以来无人质疑——完整背景见我们的 Fable 5 基准页。
这些声称大致说明:Flash 是称职的日常编码者(SWE-Bench Verified 79.0 与 LiveCodeBench 91.6 放在旗舰里也不丢人),而 DeepSeek 现在把它当 Agent 来卖,而不只是便宜的聊天模型。这个 Agent 故事在多小时、多文件的真实任务上是否成立,恰恰是还没有人验证过的部分。
成本算例:10 万条 RAG 查询
取一个代表性生产负载:每月 10 万条 RAG 查询,每条平均 2,000 输入 token(检索上下文 + 问题)与 300 输出 token,不计缓存。
| 每月成本 | Claude Fable 5 | DeepSeek V4 Flash(API) | V4 Flash(自部署) |
|---|---|---|---|
| 输入:2 亿 token | $2,000 | $28 | — |
| 输出:3,000 万 token | $1,500 | $8.40 | — |
| 合计 | $3,500 | $36.40(约省 96 倍) | 自己的 GPU——无按量费用 |
Flash 的全部论点都在这张表里:同样的负载,便宜两个数量级。开提示缓存会缩小差距但不会消失——Fable 5 缓存命中 $1/M vs Flash $0.0028/M。Fable 5 的 Batch API 可再对半砍($1,750)但要接受延迟;DeepSeek 未公布批处理档。
用成本计算器算你自己的账——如果负载涉及网络安全或生物话题,Fable 5 一侧还有安全回退这一行要算进去。
DeepSeek V4 Flash 站得住的地方
- 日常与中等复杂度编码: 生成扎实、迭代快,API 专门为编码助手流量调优。
- 吞吐: 为高容量、低延迟的管线而生。
- 成本: 决定性优势——API 上是,自部署更是:MIT 权重、无按量费用、数据不出你的基础设施。
- 可用性: 开放权重不可能被出口管制关停。这对 Fable 5 不是假设——它真的发生过,2026 年 6 月 12 日至 7 月 1 日。
Fable 5 仍然更强的地方
- 前沿 Agentic 编码: SWE-Bench Pro 80.3% 是公开模型最高分,且 Fable 5 在 100 万上下文上跑过多日自主任务。Flash 的对应声称尚未验证。
- 长链路自主: Fable 5 为多日 Agent 运行而生;Flash 档的全部意义是速度和单价,不是耐力。
- 视觉: 图表、截图、密集 PDF——Flash 是纯文本。
- 信任姿态: Anthropic 的安全闸门和它对出口管制事件的处理,是合规部门能拿来写论证的东西。
三个大多数对比都跳过的 Fable 5 专属问题
1. 30 天留存。 Fable 5 的每一次请求(输入与输出)都会为安全监控保留 30 天,零数据保留(ZDR)协议不适用。如果处理受监管数据,这一条本身就足以排除 Fable 5——而此时的替代品不是「因为便宜所以选 Flash」,而是「因为可自部署所以选 Flash」。开放权重是唯一能把一切留在自己手里的方式。详见留存政策深度解读。
2. 安全回退。 Fable 5 不拒绝网络安全与生物学相关的请求——它会把会话静默转给 Opus 4.8(Anthropic 称平均不到 5% 的对话)。两个后果:这些领域你本就没拿到 Fable 5 的能力,而且按实际作答的模型计费。如果你的负载就在这些领域,不如直接对比 Opus 5——同样的安全闸门、半价、无留存。而 Flash 的开放权重完全没有服务端闸门——这是它的卖点,也是它的风险。
3. 出口管制 vs 开放权重。 Fable 5 曾因美国出口管制指令被全球关停 19 天。DeepSeek 的 MIT 权重是永久资产——没人能撤销它们。对 AI 路线图而言,这个差别与价格差同等战略。买 Fable 5,你买的是「模型 + Anthropic 的合规机器」;买 Flash,你买的是所有权。
决策矩阵
| 如果你… | 用… |
|---|---|
| 在商品化数据上做高吞吐 RAG、抽取或批处理管线 | DeepSeek V4 Flash——约 96 倍的成本差就是全部故事 |
| 大规模做日常与中等复杂度编码 | DeepSeek V4 Flash——先在你自己代码库上验证 |
| 做前沿 Agentic 编码、多文件重构、多日自主任务 | Fable 5(或半价的 Opus 5) |
| 受零留存、数据驻留或物理隔离合规约束 | Flash 自部署——Fable 5 的 30 天留存直接出局 |
| 处于网络安全/生物科技相邻领域 | 都不是——Fable 5 的安全回退本就会转给 Opus;请对比 Opus 5 与 Flash |
| 要把产品建在出口管制关不掉的模型上 | DeepSeek V4 Flash——MIT 权重永久归你 |
| 部署需要可审计、有闸门的安全敏感场景 | Fable 5——开放权重没有安全分类器 |
| 拿不准,只想要常见负载的最佳性价比 | 先用 Flash,难任务升级 Opus 5,全程复用一份可移植提示词 |
结论
DeepSeek V4 Flash 不是「两折的 Fable 5」——它是另一个产品:一个快速、开放、便宜,对多数高吞吐工作确实够用的编码模型,外加一条尚未验证的 Agentic 宣称。Fable 5 是昂贵的选项,选它的时机是任务足够难、数据足够敏感、或监管代价足够高,让价格不再是问题。用你的工作负载算价格差、查基准证据;真要迁移,把替代品指南留作升级地图。
独立分析,截至 2026-08-04。文中所有 DeepSeek 数字均为官方自报,截至发稿未经第三方验证。