Релиз Claude Fable 5.1: 87.7% в SWE-bench, адаптивное мышление и тесты
Anthropic выпустила Claude Fable 5.1 2 сентября 2026 года. Полный обзор результатов бенчмарков (SWE-bench, FrontierMath, HLE), гибкого бюджета токенов на рассуждения и сравнение с Qwen 3.8 Max и GLM 5.3.
2 сентября 2026 г.
Редакция Fable5

2 сентября 2026 года компания Anthropic представила модель Claude Fable 5.1 (claude-fable-5-1-20260902). Это обновление устанавливает новый стандарт в автономной разработке ПО и сложных математических рассуждениях.
1. Сводка результатов бенчмарков
| Набор тестов | Claude Fable 5.1 | Claude Fable 5.0 | Разница | Область оценки |
|---|---|---|---|---|
| SWE-bench Verified | 87.7% | 80.3% | +7.4% | Исправление реальных ошибок на GitHub |
| FrontierMath | 38.2% | 29.3% | +8.9% | Исследовательская математика |
| Humanity's Last Exam (HLE) | 61.4% | 53.0% | +8.4% | Сложные логические задачи |
| OSWorld | 89.6% | 85.0% | +4.6% | Автономное управление ОС и GUI |
| GDPval-AA | 2,048 | 1,932 | +116 | Индекс автономных агентов |
| Время отклика (TTFT) | -28% | База | -28% | Скорость первого токена в Claude Code/Cursor |
| Ложные блокировки | ~2.1% | ~7.8% | -73% | Снижение переключений на Opus 4.8 |
2. Адаптивный бюджет рассуждений
Fable 5.1 поддерживает явное указание лимита токенов мышления:
{
"model": "claude-fable-5-1-20260902",
"max_tokens": 16384,
"thinking": {
"type": "enabled",
"budget_tokens": 4096
},
"messages": [...]
}
Это предотвращает избыточные вычисления на простых задачах.
Подробное сравнение доступно на странице Claude Fable 5.1 против Fable 5.