Проверено по состоянию на 4 августа 2026

Claude Fable 5 — все сравнения моделей

Одна страница — вся картина: как Claude Fable 5 сравнивается с lineup Anthropic и всеми серьёзными rival 2026 по цене, agentic coding, context, openness и best use case — каждая цифра dated и sourced, со ссылками на полные per-model comparisons.

Кратко — Fable 5 одним абзацем

Claude Fable 5 — highest-published agentic-coding model Anthropic — 80.3% на SWE-Bench Pro, $10/$50 за миллион токенов — но больше не default Claude: с 24 июля 2026 Claude Opus 5 default на Claude Max, matches capability band Fable 5 за половину цены ($5/$25) без mandatory data retention. Fable 5 для hardest agentic work — long-horizon autonomy, frontier-hard coding, full-repo 1M-token analysis — Opus 5 (или cheaper rival) для всего остального. Таблицы ниже — все nine alternatives одним взглядом.

Последняя проверка2026-08-04

Цены и benchmark figures на этой странице проверены по cited sources 4 августа 2026. Цифры Anthropic — из src/lib/model-pricing.ts, checked против pricing docs Anthropic; цифры конкурентов — из individual comparison pages на сайте (each dated and sourced) плюс vendor pages ниже. Где figure не подтверждена — «not confirmed» с датой.

Главная comparison matrix

API list prices за миллион токенов, USD, и headline facts для большинства решений. Полный context и caveats ниже и на каждой comparison page.

МодельВход (за M)Выход (за M)КонтекстОткрытые весаЛучше дляИсточник
Claude Fable 5$10.00$50.001MClosed APIAgentic coding уровня frontierОфициально (Anthropic / vendor docs)
Claude Opus 5$5.00$25.001MClosed APIDefault lane, без retentionОфициально (Anthropic / vendor docs)
Claude Sonnet 5$2.00*$10.00*1MClosed APIСбалансированный Claude tierОфициально (Anthropic / vendor docs)
Gemini 3.1 Pro$2.00$12.001MClosed APIMultimodal, стек GoogleОфициально (Anthropic / vendor docs)
GPT-5.5$5.00$30.00400KClosed APIПродукты на стеке OpenAIОфициально (Anthropic / vendor docs)
GLM 5.2~$1.40~$4.401MOpen weights (MIT)Бесплатные local open weightsПо данным вендора
DeepSeek V4 Pro$0.435$0.871MOpen weightsДешёвый strong reasoningПо данным вендора
DeepSeek V4 Flash$0.14$0.281MOpen weights (MIT)Массовый commodity-трафикПо данным вендора
Qwen 3.8 Max≈$2.00≈$6.001MAnnounced, not releasedКитай + ценаПо данным вендора
Kimi K3$3.00$15.001MOpen weightsКитайский язык + open weightsПо данным вендора

Цены Sonnet 5 introductory до 2026-08-31. Ставки Gemini 3.1 Pro для промптов до 200K токенов (выше tiers above); GPT-5.5 rates до 272K с higher long-context rates above и cheaper non-reasoning mode $1.25/$10. Цены GLM 5.2, DeepSeek V4 Pro и Flash, Qwen 3.8 Max и Kimi K3 vendor-reported и not independently verified; $2/$6 Qwen — international-list estimate — см. note под benchmark table. Source labels: «Official» = vendor documentation; «Vendor-reported» = vendor's own announcement, not independently verified.

Главная benchmark-матрица — кто что измерил

Agentic-coding и knowledge-work scores для моделей с опубликованными цифрами. Каждая цифра помечена источником; lab-published числа трактуйте как ориентировочные.

МодельClaude Fable 5Claude Opus 5GPT-5.5GLM 5.2
SWE-Bench Pro (агентное кодирование)80.3%Не подтверждено (по состоянию на 2026-08-04)58.6%62.1%
FrontierCode Diamond (сложное кодирование)29.3%Нет опубликованного score5.7%Нет опубликованного score
GDPval-AA (интеллектуальный труд)1932Нет опубликованного score1769Нет опубликованного score
OSWorld-Verified (работа с компьютером)85.0%Нет опубликованного score78.7%Нет опубликованного score

Источники: Fable 5, Opus 5, Sonnet 5 — из анонса запуска Anthropic от 9 июня 2026 и model docs (vendor self-reported, проверено по источникам Anthropic 4 августа 2026). GPT-5.5 — из запуска OpenAI (vendor self-reported). SWE-Bench Pro 62.1% GLM 5.2 и 74.4% FrontierSWE — vendor-reported через tech report GLM 5.2 (июнь 2026); колонки Opus 4.8 и GPT-5.5 в той же таблице — цифры Anthropic / OpenAI. У Gemini 3.1 Pro, DeepSeek V4 Pro, DeepSeek V4 Flash, Qwen 3.8 Max и Kimi K3 нет опубликованного SWE-Bench Pro score по состоянию на 4 августа 2026 — в ячейках так и указано, без угадывания.

Evidence parity: 80.3% Fable 5 и 58.6% GPT-5.5 — единственные две цифры SWE-Bench Pro с одним определением harness и протоколом scoring, хотя прогоны использовали настройки, выбранные лабораториями. 62.1% GLM 5.2 — другая реализация harness и не сравнима напрямую. GDPval-AA 1932 (Fable 5) и 1769 (GPT-5.5) — измерения Artificial Analysis (независимые). Ни у одной модели кроме Fable 5 нет независимо проверенного SWE-Bench Pro score по состоянию на 2026-08-04. Полный набор бенчмарков Fable 5 — на странице benchmarks.

Гид по решению — по бюджету

Что ваш price ceiling говорит о модели для старта.

  • Можете платить frontier prices ($50+ / M на выходе)

    Fable 5 ($10/$50) для hardest agentic work; Opus 5 ($5/$25) как default lane — тот же capability band на опубликованных бенчмарках, без 30-day retention. Рекомендуемая двухуровневая Claude setup.

  • Нужна solid модель до ~$15 / M на выходе

    Sonnet 5 ($2/$10, introductory до 2026-08-31), Gemini 3.1 Pro ($2/$12 при промптах до 200K токенов) или Kimi K3 ($3/$15). Sonnet 5 остаётся в экосистеме Claude; Gemini и K3 — broader multimodal и open-weight options соответственно.

  • Вы чувствительны к цене или высокий объём

    GPT-5.5 ($5/$30 или $1.25/$10 в более дешёвом non-reasoning mode), GLM 5.2 (~$1.40/$4.40 через Z.ai), DeepSeek V4 Pro ($0.435/$0.87) или DeepSeek V4 Flash ($0.14/$0.28). Flash — самая дешёвая серьёзная coding-модель на рынке, примерно в 70 раз дешевле Fable 5 на входе.

  • Нужны open weights или self-hosting

    GLM 5.2 (MIT license, бесплатно через Ollama), DeepSeek V4 Pro и V4 Flash (MIT для Flash) или Kimi K3 (~1.4 TB weights, нужно ~18 H100-class GPU — fleet project, не laptop model). Open weights Qwen 3.8 Max объявлены на «next week» 3 августа 2026, но ещё не выпущены — not confirmed.

Гид по решению — по типу задачи

Честный ответ почти всегда «both, routed by task». Per-task call ниже.

  • Agentic coding, долгосрочная автономность

    Fable 5 (80.3% SWE-Bench Pro) или Opus 5 — две highest-published models, Opus 5 за половину цены. GPT-5.5 trailing 58.6%; GLM 5.2 competitive для mid-complexity single-file work на 62.1%.

  • Повседневный и mid-complexity coding

    Любая mid-tier model clears the bar: Sonnet 5, GPT-5.5, GLM 5.2, DeepSeek V4 Pro или Flash. Выбор по price и ecosystem. Fable 5 overkill здесь, premium rarely pays.

  • Длинный контекст (окна 1M токенов)

    Fable 5, Opus 5, Sonnet 5, Gemini 3.1 Pro, GLM 5.2, DeepSeek V4 Pro/Flash, Qwen 3.8 Max и Kimi K3 — все 1M context. GPT-5.5 tops out 400K. Для context-heavy traffic cheaper models win на price; для full-repo reasoning at depth — Fable 5.

  • Китайский язык или China-hosted work

    Kimi K3 (leading Chinese-lab model на BenchAlign v5, China-hosted API) или Qwen 3.8 Max (Alibaba Cloud, RMB billing, ~$2/$6). Fable 5 — US-export-controlled API вне Китая — liability если data must stay in China.

  • Images, video или audio input

    Gemini 3.1 Pro (#1 на MMMU-Pro) для broadest multimodal stack; Qwen 3.8 Max принимает text, image и video. Fable 5 handles image и PDF input, но media-rich workflows не его edge.

Гид по решению — по жёстким ограничениям

Некоторые требования решают раньше любого бенчмарка.

  • Нужно остаться на Anthropic API

    Выбор внутренний: Fable 5 для hardest agentic work, Opus 5 как default lane за половину цены, Sonnet 5 для volume и budget. Общая API surface, caching и tooling.

  • Нужен zero data retention

    Обязательное 30-day retention Fable 5 (zero-data-retention agreements не применяются) исключает его. У Opus 5 и Sonnet 5 retention requirement нет; governance Gemini 3.1 Pro другой и следует terms Google.

  • Нужна модель, которую нельзя отключить

    Fable 5 был приостановлен worldwide 12 июня – 1 июля 2026 по US export-control directive, повтор теоретически возможен. MIT-licensed open weights (GLM 5.2, DeepSeek V4 Flash, скоро Qwen 3.8 Max) нельзя отозвать — решающий аргумент для international и enterprise teams.

  • Нужны open weights или self-hosting

    GLM 5.2 (MIT), DeepSeek V4 Flash (MIT) или Kimi K3 (Modified MIT, terms not fully confirmed). Ни одна модель Anthropic не open. Weights Qwen 3.8 Max объявлены, но не выпущены по состоянию на 2026-08-04.

  • Вы живёте в экосистеме Google или OpenAI

    Gemini 3.1 Pro если вы в Google stack (Workspace, Vertex, free tier Gemini app); GPT-5.5 если в OpenAI (structured outputs, Assistants). Switching costs часто перевешивают benchmark gaps.

Decision tree — кратко

Три вопроса, один ответ каждый — затем полное сравнение.

Q1 — Budget: свыше ~$50/M на выходе можно использовать Fable 5 или Opus 5 как escalation lane; ниже — старт из mid-tier (Sonnet 5, Gemini 3.1 Pro, GPT-5.5, Kimi K3) или low-tier (GLM 5.2, DeepSeek V4 Pro/Flash, Qwen 3.8 Max). Q2 — Task: frontier-hard agentic coding, long-horizon autonomy или full-repo 1M analysis → Fable 5; всё остальное → cheapest model, которая проходит ваш quality bar. Q3 — Constraints: must stay on Anthropic, must have zero retention, must be open-weight, must be China-hosted — каждое перекрывает первые два вопроса.

Общее правило, которое переживает любую матрицу: Fable 5 оправдывает premium только на работе, где cheap model реально fails и retries (или люди) стоят реальных денег. Используйте cheapest lane, которая succeeds, и эскалируйте hard 10–20% на Fable 5.

Evidence parity — какие цифры share a harness

Как читать таблицы, не попав в inconsistent benchmarks.

  • Сравнения в одном harness

    Fable 5 (80.3%) и GPT-5.5 (58.6%) — единственные SWE-Bench Pro figures с одним определением harness и scoring protocol — единственная directly comparable строка в таблице, settings chosen by each lab notwithstanding.

  • Независимо измеренные цифры

    GDPval-AA 1932 (Fable 5) и 1769 (GPT-5.5) — измерения Artificial Analysis. DeepSWE 68.5% Kimi K3 vs 69.9% Fable 5 — прогон Together AI (август 2026, pass@1), единственный independent head-to-head в этом lineup. Всё остальное — vendor self-reported.

  • Claims DeepSeek

    V4 Flash сообщает 79.0% на SWE-Bench Verified и 91.6 на LiveCodeBench (official technical report, not independently verified), а agentic-upgrade claims от 31 июля без independent verification. SWE-Bench Pro figure для Flash или Pro line нет — not confirmed по состоянию на 2026-08-04.

  • Claims Qwen 3.8 Max

    Alibaba claims «second only to Fable 5» на LMArena и lead на agentic computer use (OSWorld-Verified 86.1, vendor-reported), но не выпустила model card или benchmark table при launch — unverified по состоянию на 2026-08-04.

  • Claims Kimi K3

    Moonshot self-reports 67.5% на DeepSWE (max reasoning) против 70.0% Fable 5; independent Together AI run нашёл их почти tied — 68.5% vs 69.9% pass@1. У K3 нет опубликованного SWE-Bench Pro score. License terms not fully confirmed.

Посчитайте для своей нагрузки

Калькулятор стоимости сейчас моделирует lineup Anthropic (Fable 5, Opus 5, Sonnet 5 и др.) с effort levels, caching и safeguard fallback. Переключения на rival models пока нет — для сравнения конкурентов используйте list prices в матрице выше и worked examples на каждой comparison page.

Всё ещё выбираете?

Читайте deepest comparison — Fable 5 vs Opus 5, две модели, от которых зависит большинство Claude decisions — или посчитайте реальную нагрузку.

Частые вопросы