Проверено по состоянию на 4 августа 2026
Claude Fable 5 — все сравнения моделей
Одна страница — вся картина: как Claude Fable 5 сравнивается с lineup Anthropic и всеми серьёзными rival 2026 по цене, agentic coding, context, openness и best use case — каждая цифра dated и sourced, со ссылками на полные per-model comparisons.
Кратко — Fable 5 одним абзацем
Claude Fable 5 — highest-published agentic-coding model Anthropic — 80.3% на SWE-Bench Pro, $10/$50 за миллион токенов — но больше не default Claude: с 24 июля 2026 Claude Opus 5 default на Claude Max, matches capability band Fable 5 за половину цены ($5/$25) без mandatory data retention. Fable 5 для hardest agentic work — long-horizon autonomy, frontier-hard coding, full-repo 1M-token analysis — Opus 5 (или cheaper rival) для всего остального. Таблицы ниже — все nine alternatives одним взглядом.
Последняя проверка — 2026-08-04
Цены и benchmark figures на этой странице проверены по cited sources 4 августа 2026. Цифры Anthropic — из src/lib/model-pricing.ts, checked против pricing docs Anthropic; цифры конкурентов — из individual comparison pages на сайте (each dated and sourced) плюс vendor pages ниже. Где figure не подтверждена — «not confirmed» с датой.
Главная comparison matrix
API list prices за миллион токенов, USD, и headline facts для большинства решений. Полный context и caveats ниже и на каждой comparison page.
| Модель | Вход (за M) | Выход (за M) | Контекст | Открытые веса | Лучше для | Источник |
|---|---|---|---|---|---|---|
| Claude Fable 5 | $10.00 | $50.00 | 1M | Closed API | Agentic coding уровня frontier | Официально (Anthropic / vendor docs) |
| Claude Opus 5 | $5.00 | $25.00 | 1M | Closed API | Default lane, без retention | Официально (Anthropic / vendor docs) |
| Claude Sonnet 5 | $2.00* | $10.00* | 1M | Closed API | Сбалансированный Claude tier | Официально (Anthropic / vendor docs) |
| Gemini 3.1 Pro | $2.00 | $12.00 | 1M | Closed API | Multimodal, стек Google | Официально (Anthropic / vendor docs) |
| GPT-5.5 | $5.00 | $30.00 | 400K | Closed API | Продукты на стеке OpenAI | Официально (Anthropic / vendor docs) |
| GLM 5.2 | ~$1.40 | ~$4.40 | 1M | Open weights (MIT) | Бесплатные local open weights | По данным вендора |
| DeepSeek V4 Pro | $0.435 | $0.87 | 1M | Open weights | Дешёвый strong reasoning | По данным вендора |
| DeepSeek V4 Flash | $0.14 | $0.28 | 1M | Open weights (MIT) | Массовый commodity-трафик | По данным вендора |
| Qwen 3.8 Max | ≈$2.00 | ≈$6.00 | 1M | Announced, not released | Китай + цена | По данным вендора |
| Kimi K3 | $3.00 | $15.00 | 1M | Open weights | Китайский язык + open weights | По данным вендора |
Цены Sonnet 5 introductory до 2026-08-31. Ставки Gemini 3.1 Pro для промптов до 200K токенов (выше tiers above); GPT-5.5 rates до 272K с higher long-context rates above и cheaper non-reasoning mode $1.25/$10. Цены GLM 5.2, DeepSeek V4 Pro и Flash, Qwen 3.8 Max и Kimi K3 vendor-reported и not independently verified; $2/$6 Qwen — international-list estimate — см. note под benchmark table. Source labels: «Official» = vendor documentation; «Vendor-reported» = vendor's own announcement, not independently verified.
Главная benchmark-матрица — кто что измерил
Agentic-coding и knowledge-work scores для моделей с опубликованными цифрами. Каждая цифра помечена источником; lab-published числа трактуйте как ориентировочные.
| Модель | Claude Fable 5 | Claude Opus 5 | GPT-5.5 | GLM 5.2 |
|---|---|---|---|---|
| SWE-Bench Pro (агентное кодирование) | 80.3% | Не подтверждено (по состоянию на 2026-08-04) | 58.6% | 62.1% |
| FrontierCode Diamond (сложное кодирование) | 29.3% | Нет опубликованного score | 5.7% | Нет опубликованного score |
| GDPval-AA (интеллектуальный труд) | 1932 | Нет опубликованного score | 1769 | Нет опубликованного score |
| OSWorld-Verified (работа с компьютером) | 85.0% | Нет опубликованного score | 78.7% | Нет опубликованного score |
Источники: Fable 5, Opus 5, Sonnet 5 — из анонса запуска Anthropic от 9 июня 2026 и model docs (vendor self-reported, проверено по источникам Anthropic 4 августа 2026). GPT-5.5 — из запуска OpenAI (vendor self-reported). SWE-Bench Pro 62.1% GLM 5.2 и 74.4% FrontierSWE — vendor-reported через tech report GLM 5.2 (июнь 2026); колонки Opus 4.8 и GPT-5.5 в той же таблице — цифры Anthropic / OpenAI. У Gemini 3.1 Pro, DeepSeek V4 Pro, DeepSeek V4 Flash, Qwen 3.8 Max и Kimi K3 нет опубликованного SWE-Bench Pro score по состоянию на 4 августа 2026 — в ячейках так и указано, без угадывания.
Evidence parity: 80.3% Fable 5 и 58.6% GPT-5.5 — единственные две цифры SWE-Bench Pro с одним определением harness и протоколом scoring, хотя прогоны использовали настройки, выбранные лабораториями. 62.1% GLM 5.2 — другая реализация harness и не сравнима напрямую. GDPval-AA 1932 (Fable 5) и 1769 (GPT-5.5) — измерения Artificial Analysis (независимые). Ни у одной модели кроме Fable 5 нет независимо проверенного SWE-Bench Pro score по состоянию на 2026-08-04. Полный набор бенчмарков Fable 5 — на странице benchmarks.
Гид по решению — по бюджету
Что ваш price ceiling говорит о модели для старта.
Можете платить frontier prices ($50+ / M на выходе)
Fable 5 ($10/$50) для hardest agentic work; Opus 5 ($5/$25) как default lane — тот же capability band на опубликованных бенчмарках, без 30-day retention. Рекомендуемая двухуровневая Claude setup.
Нужна solid модель до ~$15 / M на выходе
Sonnet 5 ($2/$10, introductory до 2026-08-31), Gemini 3.1 Pro ($2/$12 при промптах до 200K токенов) или Kimi K3 ($3/$15). Sonnet 5 остаётся в экосистеме Claude; Gemini и K3 — broader multimodal и open-weight options соответственно.
Вы чувствительны к цене или высокий объём
GPT-5.5 ($5/$30 или $1.25/$10 в более дешёвом non-reasoning mode), GLM 5.2 (~$1.40/$4.40 через Z.ai), DeepSeek V4 Pro ($0.435/$0.87) или DeepSeek V4 Flash ($0.14/$0.28). Flash — самая дешёвая серьёзная coding-модель на рынке, примерно в 70 раз дешевле Fable 5 на входе.
Нужны open weights или self-hosting
GLM 5.2 (MIT license, бесплатно через Ollama), DeepSeek V4 Pro и V4 Flash (MIT для Flash) или Kimi K3 (~1.4 TB weights, нужно ~18 H100-class GPU — fleet project, не laptop model). Open weights Qwen 3.8 Max объявлены на «next week» 3 августа 2026, но ещё не выпущены — not confirmed.
Гид по решению — по типу задачи
Честный ответ почти всегда «both, routed by task». Per-task call ниже.
Agentic coding, долгосрочная автономность
Fable 5 (80.3% SWE-Bench Pro) или Opus 5 — две highest-published models, Opus 5 за половину цены. GPT-5.5 trailing 58.6%; GLM 5.2 competitive для mid-complexity single-file work на 62.1%.
Повседневный и mid-complexity coding
Любая mid-tier model clears the bar: Sonnet 5, GPT-5.5, GLM 5.2, DeepSeek V4 Pro или Flash. Выбор по price и ecosystem. Fable 5 overkill здесь, premium rarely pays.
Длинный контекст (окна 1M токенов)
Fable 5, Opus 5, Sonnet 5, Gemini 3.1 Pro, GLM 5.2, DeepSeek V4 Pro/Flash, Qwen 3.8 Max и Kimi K3 — все 1M context. GPT-5.5 tops out 400K. Для context-heavy traffic cheaper models win на price; для full-repo reasoning at depth — Fable 5.
Китайский язык или China-hosted work
Kimi K3 (leading Chinese-lab model на BenchAlign v5, China-hosted API) или Qwen 3.8 Max (Alibaba Cloud, RMB billing, ~$2/$6). Fable 5 — US-export-controlled API вне Китая — liability если data must stay in China.
Images, video или audio input
Gemini 3.1 Pro (#1 на MMMU-Pro) для broadest multimodal stack; Qwen 3.8 Max принимает text, image и video. Fable 5 handles image и PDF input, но media-rich workflows не его edge.
Гид по решению — по жёстким ограничениям
Некоторые требования решают раньше любого бенчмарка.
Нужно остаться на Anthropic API
Выбор внутренний: Fable 5 для hardest agentic work, Opus 5 как default lane за половину цены, Sonnet 5 для volume и budget. Общая API surface, caching и tooling.
Нужен zero data retention
Обязательное 30-day retention Fable 5 (zero-data-retention agreements не применяются) исключает его. У Opus 5 и Sonnet 5 retention requirement нет; governance Gemini 3.1 Pro другой и следует terms Google.
Нужна модель, которую нельзя отключить
Fable 5 был приостановлен worldwide 12 июня – 1 июля 2026 по US export-control directive, повтор теоретически возможен. MIT-licensed open weights (GLM 5.2, DeepSeek V4 Flash, скоро Qwen 3.8 Max) нельзя отозвать — решающий аргумент для international и enterprise teams.
Нужны open weights или self-hosting
GLM 5.2 (MIT), DeepSeek V4 Flash (MIT) или Kimi K3 (Modified MIT, terms not fully confirmed). Ни одна модель Anthropic не open. Weights Qwen 3.8 Max объявлены, но не выпущены по состоянию на 2026-08-04.
Вы живёте в экосистеме Google или OpenAI
Gemini 3.1 Pro если вы в Google stack (Workspace, Vertex, free tier Gemini app); GPT-5.5 если в OpenAI (structured outputs, Assistants). Switching costs часто перевешивают benchmark gaps.
Decision tree — кратко
Три вопроса, один ответ каждый — затем полное сравнение.
Q1 — Budget: свыше ~$50/M на выходе можно использовать Fable 5 или Opus 5 как escalation lane; ниже — старт из mid-tier (Sonnet 5, Gemini 3.1 Pro, GPT-5.5, Kimi K3) или low-tier (GLM 5.2, DeepSeek V4 Pro/Flash, Qwen 3.8 Max). Q2 — Task: frontier-hard agentic coding, long-horizon autonomy или full-repo 1M analysis → Fable 5; всё остальное → cheapest model, которая проходит ваш quality bar. Q3 — Constraints: must stay on Anthropic, must have zero retention, must be open-weight, must be China-hosted — каждое перекрывает первые два вопроса.
Общее правило, которое переживает любую матрицу: Fable 5 оправдывает premium только на работе, где cheap model реально fails и retries (или люди) стоят реальных денег. Используйте cheapest lane, которая succeeds, и эскалируйте hard 10–20% на Fable 5.
Evidence parity — какие цифры share a harness
Как читать таблицы, не попав в inconsistent benchmarks.
Сравнения в одном harness
Fable 5 (80.3%) и GPT-5.5 (58.6%) — единственные SWE-Bench Pro figures с одним определением harness и scoring protocol — единственная directly comparable строка в таблице, settings chosen by each lab notwithstanding.
Независимо измеренные цифры
GDPval-AA 1932 (Fable 5) и 1769 (GPT-5.5) — измерения Artificial Analysis. DeepSWE 68.5% Kimi K3 vs 69.9% Fable 5 — прогон Together AI (август 2026, pass@1), единственный independent head-to-head в этом lineup. Всё остальное — vendor self-reported.
Claims DeepSeek
V4 Flash сообщает 79.0% на SWE-Bench Verified и 91.6 на LiveCodeBench (official technical report, not independently verified), а agentic-upgrade claims от 31 июля без independent verification. SWE-Bench Pro figure для Flash или Pro line нет — not confirmed по состоянию на 2026-08-04.
Claims Qwen 3.8 Max
Alibaba claims «second only to Fable 5» на LMArena и lead на agentic computer use (OSWorld-Verified 86.1, vendor-reported), но не выпустила model card или benchmark table при launch — unverified по состоянию на 2026-08-04.
Claims Kimi K3
Moonshot self-reports 67.5% на DeepSWE (max reasoning) против 70.0% Fable 5; independent Together AI run нашёл их почти tied — 68.5% vs 69.9% pass@1. У K3 нет опубликованного SWE-Bench Pro score. License terms not fully confirmed.
Посчитайте для своей нагрузки
Калькулятор стоимости сейчас моделирует lineup Anthropic (Fable 5, Opus 5, Sonnet 5 и др.) с effort levels, caching и safeguard fallback. Переключения на rival models пока нет — для сравнения конкурентов используйте list prices в матрице выше и worked examples на каждой comparison page.
Всё ещё выбираете?
Читайте deepest comparison — Fable 5 vs Opus 5, две модели, от которых зависит большинство Claude decisions — или посчитайте реальную нагрузку.