Данные актуальны на 14 сентября 2026; цифры DeepSeek — от вендора

V4.1 Flash вышла 10 сентября 2026; все её бенчмарки — из модельной карты DeepSeek, независимых прогонов на момент проверки не было. Цены взяты с официального прайса DeepSeek (непиковые) и из документации Anthropic.

Наше прошлое сравнение: Fable 5 против DeepSeek V4 Pro

DeepSeek V4.1 Flash против Claude Fable 5.1 · сентябрь 2026

DeepSeek V4.1 Flash против Claude Fable 5.1

Открытая модель на $0,15 в непиковые часы против закрытого флагмана за $10 — одно окно в 1M токенов, но разная цена и разная доказательная база.

Коротко

DeepSeek V4.1 Flash стоит $0,15/$0,60 за млн токенов (ввод/вывод) в непиковое время и вдвое дороже в часы пик; Claude Fable 5.1 — плоские $10/$50 круглосуточно: разница по входу в 67 раз по прайсу на 14 сентября 2026. V4.1 Flash — MoE на 552B параметров, веса под MIT, контекст 1M, вывод до 384K; результаты в агентном кодинге заявлены самим DeepSeek и пока не подтверждены независимо. У Fable 5.1 проверенная сторона — SWE-bench Verified 87,7% и официальный прайс Anthropic.

Ключевые характеристики

У DeepSeek — непиковые цены; в часы пик (пн-пт 01:00-04:00 и 06:00-10:00 UTC) всё дорожает вдвое. Fable 5.1 тарифицирует ровно и круглосуточно.

ПараметрDeepSeek V4.1 FlashClaude Fable 5.1
ID моделиdeepseek-flashclaude-fable-5-1-20260902
Релиз10 сентября 20262 сентября 2026
Цена входа (за млн токенов)$0.15$10.00
Цена выхода (за млн токенов)$0.60$50.00
Пиковая тарификацияВ пик вдвое дороже ($0,30 / $1,20)Плоские цены 24/7 на любом контексте
Чтение кэша (за млн токенов)$0.003$0.25
АрхитектураMoE 552B: 8B активных на prefill, 16B на decodeНе раскрывается (закрытый API)
Веса и лицензияОткрытые веса MIT (~510 ГБ, FP8)Проприетарные: только API и облака
Контекст1M1M
Максимум вывода384K128K

Вход дороже в 67 раз, выход — в 83. Кэш DeepSeek: попадание $0,003 за млн токенов без платы за запись. Кэш Fable 5.1: чтение $0,25 за млн после платной записи ($12,50 за 5-минутную). Самостоятельный хостинг меняет расклад: чекпойнт V4.1 Flash (~510 ГБ в FP8, MIT) требует узла на 8 GPU, а для Fable 5.1 открытых весов не существует.

Бенчмарки: слова вендора против проверенных цифр

По модели DeepSeek, V4.1 Flash обгоняет собственный V4 Pro в агентных и кодинг-тестах. У Fable 5.1 самый сильный проверяемый результат — SWE-bench Verified 87,7%. Единственное пересечение одного поколения — Terminal-Bench 4.0, притом в разных харнесах.

ПараметрDeepSeek V4.1 FlashClaude Fable 5.1
SWE-bench VerifiedНе подтверждено87.7%
DeepSWE v1.174.2%Не подтверждено
Terminal-Bench 2.190.6%Не подтверждено
Terminal-Bench 4.031.2%55.8%
GPQA Diamond90.9%Не подтверждено
HLE (без инструментов)36.8%Не подтверждено

Источники: DeepSWE, Terminal-Bench 2.1, GPQA Diamond и HLE — прогоны самого DeepSeek из модельной карты от 10 сентября 2026 (максимальный уровень размышления), независимо не воспроизведены. Строка Terminal-Bench 4.0 снята в разных харнесах: 31,2% — у DeepSeek, 55,8% — из кросс-прогонов OpenAI, опубликованных с GPT-6 Astra. SWE-bench Verified — данные Anthropic; DeepSeek его не публиковал. Разницу «вендор против вендора» считайте ориентиром, а не окончательным вердиктом.

Как выбирать

Окно одно — цены и стандарт доказательств разные. Маршрутизируйте по задаче.

  • Много агентных вызовов, и счёт — узкое место

    $0,15/$0,60 в непиковое время: вход агентного цикла дешевеет в десятки раз. Все выходные и большая часть рабочего дня в США тарифицируются по непиковой цене. Если потолок — бюджет, а не возможности, аргументов против не найдётся.

  • Нужен проверяемый агентный кодинг

    За Fable 5.1 — опубликованные 87,7% SWE-bench Verified и покрытия Artificial Analysis; DeepSWE 74,2 и Terminal-Bench 2.1 90,6 у V4.1 Flash — собственные прогоны DeepSeek, на 14 сентября независимых повторений не было.

  • Нужны веса, а не только API

    MIT, чекпойнт ~510 ГБ FP8, vLLM и SGLang с первого дня — приватный контур возможен, но стартовая планка — сервер на 8 GPU. Fable 5.1 закрыт: API Anthropic, Bedrock, Vertex AI, Microsoft Foundry и ничего больше.

  • Много «чистого» знания без инструментов

    Сама таблица DeepSeek показывает предел: HLE 36,8 против 42,7 у V4 Pro — V4.1 Flash быстр, но по знаниям это Flash-класс. Длинные текстовые рассуждения без retrieval-подпорки по-прежнему надёжнее доверить Fable 5.1.

  • Промпты в основном повторяются

    Повторные прогоны стабильного контекста попадают в строку кэша: $0,003 за млн у V4.1 Flash (непик, запись бесплатна) против $0,25 у Fable 5.1 (после платной записи). Обе цифры на порядки дешевле собственного входа — раскладку Anthropic мы разобрали на странице про prompt caching.

Честный итог: V4.1 Flash даёт вход в 67 раз дешевле и настоящие открытые веса — ценой неизмеренных бенчмарков, пиковых окон и потолка в знаниях. Fable 5.1 — проверенная глубина в кодинге и плоская цена по всему миллиону контекста. Ответ перезапишется, как только Artificial Analysis опубликует V4.1 Flash; мы обновим страницу.

Посчитайте свою нагрузку

Доля попаданий в кэш, пиковые окна и длина вывода влияют на счёт сильнее, чем разрыв прайсов. Смоделируйте свой микс токенов по текущему прайсу.

FAQ