Вернуться в блог

Релиз Claude Fable 5.1: 87.7% в SWE-bench, адаптивное мышление и тесты

Anthropic выпустила Claude Fable 5.1 2 сентября 2026 года. Полный обзор результатов бенчмарков (SWE-bench, FrontierMath, HLE), гибкого бюджета токенов на рассуждения и сравнение с Qwen 3.8 Max и GLM 5.3.

2 сентября 2026 г.Редакция Fable5Редакция Fable5
Релиз Claude Fable 5.1: 87.7% в SWE-bench, адаптивное мышление и тесты

2 сентября 2026 года компания Anthropic представила модель Claude Fable 5.1 (claude-fable-5-1-20260902). Это обновление устанавливает новый стандарт в автономной разработке ПО и сложных математических рассуждениях.


1. Сводка результатов бенчмарков

Набор тестовClaude Fable 5.1Claude Fable 5.0РазницаОбласть оценки
SWE-bench Verified87.7%80.3%+7.4%Исправление реальных ошибок на GitHub
FrontierMath38.2%29.3%+8.9%Исследовательская математика
Humanity's Last Exam (HLE)61.4%53.0%+8.4%Сложные логические задачи
OSWorld89.6%85.0%+4.6%Автономное управление ОС и GUI
GDPval-AA2,0481,932+116Индекс автономных агентов
Время отклика (TTFT)-28%База-28%Скорость первого токена в Claude Code/Cursor
Ложные блокировки~2.1%~7.8%-73%Снижение переключений на Opus 4.8

2. Адаптивный бюджет рассуждений

Fable 5.1 поддерживает явное указание лимита токенов мышления:

{
  "model": "claude-fable-5-1-20260902",
  "max_tokens": 16384,
  "thinking": {
    "type": "enabled",
    "budget_tokens": 4096
  },
  "messages": [...]
}

Это предотвращает избыточные вычисления на простых задачах.

Подробное сравнение доступно на странице Claude Fable 5.1 против Fable 5.

Похожие статьи