返回博客

Claude Fable 5 对比 DeepSeek V4 Flash:价格、编码能力,以及何时该切换

DeepSeek V4 Flash 比 Claude Fable 5 便宜约两个数量级(每百万 token $0.14/$0.28 vs $10/$50,截至 2026-08-04)。你会损失多少编码能力、Flash 何时真的够用,以及 Fable 5 独有的限制(30 天留存、安全回退、出口管制)如何改变这笔账。

2026年8月4日Fable5 编辑部Fable5 编辑部

TL;DR(截至 2026-08-04): DeepSeek V4 Flash 是市面上最便宜的严肃编码模型——每百万 token $0.14 / $0.28,MIT 许可开放权重,100 万上下文——对比 Fable 5 的 $10 / $50(输入约 70 倍、输出约 180 倍价差)。日常与中等复杂度编码它真的够用;前沿 Agentic 编码与长链路自主任务则没有证据它能比肩 Fable 5——其主打 Agentic 数字发布仅四天且未经验证。安全敏感、受监管或合规约束的工作,选 Fable 5(或半价的同门 Opus 5)才是站得住的答案。动手迁移前先用成本计算器算一笔账。

DeepSeek V4 Flash 速览

DeepSeek V4 Flash 是 DeepSeek V4 系列中的「Flash 档」——面向编码助手、对话代理和批处理管线的低成本、高吞吐模型。当前版本为 V4 Flash 07312026 年 7 月 31 日发布:与四月预览版同架构,仅重新做后训练,并附带 DSpark 投机解码组件和大幅宣称的 Agentic 能力提升。与 Fable 5 不同,它纯文本(无视觉),权重 MIT 许可——整个模型都能自部署。

在 DeepSeek 自家产品线里,它比 DeepSeek V4 Pro($0.435/$0.87)低一档——Flash 约为 Pro 价格的三分之一。

规格对照

规格Claude Fable 5DeepSeek V4 Flash (0731)
厂商AnthropicDeepSeek
定位旗舰级安全优先 Agentic 模型低成本、高吞吐「Flash」档
输入 / 输出价格(每百万 token)$10 / $50$0.14 / $0.28
缓存命中输入(每百万 token)$1$0.0028
上下文窗口100 万100 万
最大输出128K384K
许可闭源,仅 APIMIT 开放权重(可自部署)
参数量未公布约 284B MoE,每 token 激活约 13B
模态文本 + 视觉纯文本
速度定位前沿推理、长链路自主快速、便宜、高吞吐
数据留存强制 30 天(ZDR 不豁免)由你的政策决定(API)/ 完全自己掌控(自部署)

价格分别以 DeepSeek API 文档与 Anthropic 公布为准(Fable 5 验证于 2026-07-27,Flash 于 2026-08-04)。注意 DeepSeek 已宣布计划推出高峰时段 2 倍价(北京时间 9:00–12:00 与 14:00–18:00),生效日期尚未公布,截至 2026-08-04 仍为平价。

基准对照:公布了什么、没公布什么

先说尴尬的事实:两个模型几乎不公布重叠的基准,所以不存在干净的正面交锋。

基准Claude Fable 5DeepSeek V4 Flash来源
SWE-Bench Pro80.3%未公布Fable 5:Anthropic 2026-06-09 发布表(官方)
SWE-Bench Verified未公布79.0%DeepSeek V4 技术报告(官方自报,未经独立验证)
LiveCodeBench未公布91.6DeepSeek V4 技术报告(官方自报)
Codeforces(评级)未公布3052DeepSeek V4 技术报告(官方自报)
Terminal Bench 2.0未公布56.9DeepSeek V4 技术报告(官方自报)
Terminal Bench 2.1未公布82.7DeepSeek 0731 更新日志,2026-07-31(官方自报;内部评测工具,最高 effort)
MMLU-Pro未公布86.2DeepSeek V4 技术报告(官方自报)

读这些数字之前先记住两点:

  • 基准不可比。 SWE-Bench Pro(Fable 5)与 SWE-Bench Verified(Flash)是难度不同的两套测试集。「79.0 vs 80.3」直接对比是错误——测试根本不同。
  • 截至 2026-08-04,Flash 一侧没有任何独立验证。 Agentic 数字(Terminal Bench 2.1 82.7、DeepSWE 54.4、NL2Repo 54.2)来自 DeepSeek 自家发布四天的更新日志;更早的 Flash 系列编码分数来自 DeepSeek 技术报告。在第三方跑过之前,都按自报处理。反观 Fable 5 的 SWE-Bench Pro 80.3%,自 6 月 9 日公开以来无人质疑——完整背景见我们的 Fable 5 基准页

这些声称大致说明:Flash 是称职的日常编码者(SWE-Bench Verified 79.0 与 LiveCodeBench 91.6 放在旗舰里也不丢人),而 DeepSeek 现在把它当 Agent 来卖,而不只是便宜的聊天模型。这个 Agent 故事在多小时、多文件的真实任务上是否成立,恰恰是还没有人验证过的部分。

成本算例:10 万条 RAG 查询

取一个代表性生产负载:每月 10 万条 RAG 查询,每条平均 2,000 输入 token(检索上下文 + 问题)与 300 输出 token,不计缓存。

每月成本Claude Fable 5DeepSeek V4 Flash(API)V4 Flash(自部署)
输入:2 亿 token$2,000$28
输出:3,000 万 token$1,500$8.40
合计$3,500$36.40(约省 96 倍)自己的 GPU——无按量费用

Flash 的全部论点都在这张表里:同样的负载,便宜两个数量级。开提示缓存会缩小差距但不会消失——Fable 5 缓存命中 $1/M vs Flash $0.0028/M。Fable 5 的 Batch API 可再对半砍($1,750)但要接受延迟;DeepSeek 未公布批处理档。

成本计算器算你自己的账——如果负载涉及网络安全或生物话题,Fable 5 一侧还有安全回退这一行要算进去。

DeepSeek V4 Flash 站得住的地方

  • 日常与中等复杂度编码: 生成扎实、迭代快,API 专门为编码助手流量调优。
  • 吞吐: 为高容量、低延迟的管线而生。
  • 成本: 决定性优势——API 上是,自部署更是:MIT 权重、无按量费用、数据不出你的基础设施。
  • 可用性: 开放权重不可能被出口管制关停。这对 Fable 5 不是假设——它真的发生过,2026 年 6 月 12 日至 7 月 1 日

Fable 5 仍然更强的地方

  • 前沿 Agentic 编码: SWE-Bench Pro 80.3% 是公开模型最高分,且 Fable 5 在 100 万上下文上跑过多日自主任务。Flash 的对应声称尚未验证。
  • 长链路自主: Fable 5 为多日 Agent 运行而生;Flash 档的全部意义是速度和单价,不是耐力。
  • 视觉: 图表、截图、密集 PDF——Flash 是纯文本。
  • 信任姿态: Anthropic 的安全闸门和它对出口管制事件的处理,是合规部门能拿来写论证的东西。

三个大多数对比都跳过的 Fable 5 专属问题

1. 30 天留存。 Fable 5 的每一次请求(输入与输出)都会为安全监控保留 30 天,零数据保留(ZDR)协议不适用。如果处理受监管数据,这一条本身就足以排除 Fable 5——而此时的替代品不是「因为便宜所以选 Flash」,而是「因为可自部署所以选 Flash」。开放权重是唯一能把一切留在自己手里的方式。详见留存政策深度解读

2. 安全回退。 Fable 5 不拒绝网络安全与生物学相关的请求——它会把会话静默转给 Opus 4.8(Anthropic 称平均不到 5% 的对话)。两个后果:这些领域你本就没拿到 Fable 5 的能力,而且按实际作答的模型计费。如果你的负载就在这些领域,不如直接对比 Opus 5——同样的安全闸门、半价、无留存。而 Flash 的开放权重完全没有服务端闸门——这是它的卖点,也是它的风险。

3. 出口管制 vs 开放权重。 Fable 5 曾因美国出口管制指令被全球关停 19 天。DeepSeek 的 MIT 权重是永久资产——没人能撤销它们。对 AI 路线图而言,这个差别与价格差同等战略。买 Fable 5,你买的是「模型 + Anthropic 的合规机器」;买 Flash,你买的是所有权。

决策矩阵

如果你…用…
在商品化数据上做高吞吐 RAG、抽取或批处理管线DeepSeek V4 Flash——约 96 倍的成本差就是全部故事
大规模做日常与中等复杂度编码DeepSeek V4 Flash——先在你自己代码库上验证
做前沿 Agentic 编码、多文件重构、多日自主任务Fable 5(或半价的 Opus 5)
受零留存、数据驻留或物理隔离合规约束Flash 自部署——Fable 5 的 30 天留存直接出局
处于网络安全/生物科技相邻领域都不是——Fable 5 的安全回退本就会转给 Opus;请对比 Opus 5 与 Flash
要把产品建在出口管制关不掉的模型上DeepSeek V4 Flash——MIT 权重永久归你
部署需要可审计、有闸门的安全敏感场景Fable 5——开放权重没有安全分类器
拿不准,只想要常见负载的最佳性价比先用 Flash,难任务升级 Opus 5,全程复用一份可移植提示词

结论

DeepSeek V4 Flash 不是「两折的 Fable 5」——它是另一个产品:一个快速、开放、便宜,对多数高吞吐工作确实够用的编码模型,外加一条尚未验证的 Agentic 宣称。Fable 5 是昂贵的选项,选它的时机是任务足够难、数据足够敏感、或监管代价足够高,让价格不再是问题。用你的工作负载算价格差、查基准证据;真要迁移,把替代品指南留作升级地图。

独立分析,截至 2026-08-04。文中所有 DeepSeek 数字均为官方自报,截至发稿未经第三方验证。

相关文章