Данные актуальны на 14 сентября 2026; цифры DeepSeek — от вендора
V4.1 Flash вышла 10 сентября 2026; все её бенчмарки — из модельной карты DeepSeek, независимых прогонов на момент проверки не было. Цены взяты с официального прайса DeepSeek (непиковые) и из документации Anthropic.
Наше прошлое сравнение: Fable 5 против DeepSeek V4 ProDeepSeek V4.1 Flash против Claude Fable 5.1 · сентябрь 2026
DeepSeek V4.1 Flash против Claude Fable 5.1
Открытая модель на $0,15 в непиковые часы против закрытого флагмана за $10 — одно окно в 1M токенов, но разная цена и разная доказательная база.
Коротко
DeepSeek V4.1 Flash стоит $0,15/$0,60 за млн токенов (ввод/вывод) в непиковое время и вдвое дороже в часы пик; Claude Fable 5.1 — плоские $10/$50 круглосуточно: разница по входу в 67 раз по прайсу на 14 сентября 2026. V4.1 Flash — MoE на 552B параметров, веса под MIT, контекст 1M, вывод до 384K; результаты в агентном кодинге заявлены самим DeepSeek и пока не подтверждены независимо. У Fable 5.1 проверенная сторона — SWE-bench Verified 87,7% и официальный прайс Anthropic.
Ключевые характеристики
У DeepSeek — непиковые цены; в часы пик (пн-пт 01:00-04:00 и 06:00-10:00 UTC) всё дорожает вдвое. Fable 5.1 тарифицирует ровно и круглосуточно.
| Параметр | DeepSeek V4.1 Flash | Claude Fable 5.1 |
|---|---|---|
| ID модели | deepseek-flash | claude-fable-5-1-20260902 |
| Релиз | 10 сентября 2026 | 2 сентября 2026 |
| Цена входа (за млн токенов) | $0.15 | $10.00 |
| Цена выхода (за млн токенов) | $0.60 | $50.00 |
| Пиковая тарификация | В пик вдвое дороже ($0,30 / $1,20) | Плоские цены 24/7 на любом контексте |
| Чтение кэша (за млн токенов) | $0.003 | $0.25 |
| Архитектура | MoE 552B: 8B активных на prefill, 16B на decode | Не раскрывается (закрытый API) |
| Веса и лицензия | Открытые веса MIT (~510 ГБ, FP8) | Проприетарные: только API и облака |
| Контекст | 1M | 1M |
| Максимум вывода | 384K | 128K |
Вход дороже в 67 раз, выход — в 83. Кэш DeepSeek: попадание $0,003 за млн токенов без платы за запись. Кэш Fable 5.1: чтение $0,25 за млн после платной записи ($12,50 за 5-минутную). Самостоятельный хостинг меняет расклад: чекпойнт V4.1 Flash (~510 ГБ в FP8, MIT) требует узла на 8 GPU, а для Fable 5.1 открытых весов не существует.
Бенчмарки: слова вендора против проверенных цифр
По модели DeepSeek, V4.1 Flash обгоняет собственный V4 Pro в агентных и кодинг-тестах. У Fable 5.1 самый сильный проверяемый результат — SWE-bench Verified 87,7%. Единственное пересечение одного поколения — Terminal-Bench 4.0, притом в разных харнесах.
| Параметр | DeepSeek V4.1 Flash | Claude Fable 5.1 |
|---|---|---|
| SWE-bench Verified | Не подтверждено | 87.7% |
| DeepSWE v1.1 | 74.2% | Не подтверждено |
| Terminal-Bench 2.1 | 90.6% | Не подтверждено |
| Terminal-Bench 4.0 | 31.2% | 55.8% |
| GPQA Diamond | 90.9% | Не подтверждено |
| HLE (без инструментов) | 36.8% | Не подтверждено |
Источники: DeepSWE, Terminal-Bench 2.1, GPQA Diamond и HLE — прогоны самого DeepSeek из модельной карты от 10 сентября 2026 (максимальный уровень размышления), независимо не воспроизведены. Строка Terminal-Bench 4.0 снята в разных харнесах: 31,2% — у DeepSeek, 55,8% — из кросс-прогонов OpenAI, опубликованных с GPT-6 Astra. SWE-bench Verified — данные Anthropic; DeepSeek его не публиковал. Разницу «вендор против вендора» считайте ориентиром, а не окончательным вердиктом.
Как выбирать
Окно одно — цены и стандарт доказательств разные. Маршрутизируйте по задаче.
Много агентных вызовов, и счёт — узкое место
$0,15/$0,60 в непиковое время: вход агентного цикла дешевеет в десятки раз. Все выходные и большая часть рабочего дня в США тарифицируются по непиковой цене. Если потолок — бюджет, а не возможности, аргументов против не найдётся.
Нужен проверяемый агентный кодинг
За Fable 5.1 — опубликованные 87,7% SWE-bench Verified и покрытия Artificial Analysis; DeepSWE 74,2 и Terminal-Bench 2.1 90,6 у V4.1 Flash — собственные прогоны DeepSeek, на 14 сентября независимых повторений не было.
Нужны веса, а не только API
MIT, чекпойнт ~510 ГБ FP8, vLLM и SGLang с первого дня — приватный контур возможен, но стартовая планка — сервер на 8 GPU. Fable 5.1 закрыт: API Anthropic, Bedrock, Vertex AI, Microsoft Foundry и ничего больше.
Много «чистого» знания без инструментов
Сама таблица DeepSeek показывает предел: HLE 36,8 против 42,7 у V4 Pro — V4.1 Flash быстр, но по знаниям это Flash-класс. Длинные текстовые рассуждения без retrieval-подпорки по-прежнему надёжнее доверить Fable 5.1.
Промпты в основном повторяются
Повторные прогоны стабильного контекста попадают в строку кэша: $0,003 за млн у V4.1 Flash (непик, запись бесплатна) против $0,25 у Fable 5.1 (после платной записи). Обе цифры на порядки дешевле собственного входа — раскладку Anthropic мы разобрали на странице про prompt caching.
Честный итог: V4.1 Flash даёт вход в 67 раз дешевле и настоящие открытые веса — ценой неизмеренных бенчмарков, пиковых окон и потолка в знаниях. Fable 5.1 — проверенная глубина в кодинге и плоская цена по всему миллиону контекста. Ответ перезапишется, как только Artificial Analysis опубликует V4.1 Flash; мы обновим страницу.
Посчитайте свою нагрузку
Доля попаданий в кэш, пиковые окна и длина вывода влияют на счёт сильнее, чем разрыв прайсов. Смоделируйте свой микс токенов по текущему прайсу.