529 overloaded_error
529 overloaded_error в Claude Fable 5
API временно перегружен. Причина не в вашем запросе и не в учётной записи, а единственное действенное исправление — задержка перед повтором.
Кратко за 30 секунд
529 — это overloaded_error: API Anthropic временно исчерпал мощность, обычно из-за высокого трафика всех клиентов. Это не лимит запросов и не расходует квоту. Повторяйте запрос с экспоненциальной задержкой, при затяжной проблеме проверьте status.claude.com и держите вторую модель наготове, поскольку серверный параметр fallbacks не обрабатывает перегрузку.
Что действительно вызывает 529
Все четыре причины находятся на стороне Anthropic. Изменение payload не устранит ни одну из них.
Длинные ответы Fable 5 увеличивают период риска
Отдельные запросы Fable 5 к сложным задачам при высоком effort могут выполняться много минут. Чем дольше запрос находится в обработке, тем выше вероятность, что он попадёт на период нехватки мощности; перегрузка в середине потока приходит уже после возврата HTTP 200.
Заголовка с предупреждением заранее нет
В отличие от 429, при перегрузке нет заголовков с оставшейся мощностью, которые можно отслеживать. Предсказать 529 по метаданным ответа нельзя, поэтому нужна реактивная задержка перед повтором, а не упреждающее ограничение трафика.
Пиковый спрос на одну модель
Вычислительная мощность учитывается отдельно для каждой модели, поэтому Fable 5 может быть перегружена, пока Opus 5 и Sonnet 5 отвечают нормально. Claude Code прямо сообщает об этом: выполните /model и переключитесь, если одна из моделей испытывает особенно высокую нагрузку.
Нехватка мощности всей платформы, а не вашей учётной записи
Ошибки 529 возникают, когда API получает высокий трафик от всех пользователей. Уровень вашей организации, лимит расходов и лимиты запросов не влияют на появление этой ошибки. Два клиента с совершенно разным характером использования увидят 529 в один и тот же период.
Исправляйте в таком порядке
Первый и второй шаги решают почти все случаи. Шаги с третьего по пятый нужны при длительных инцидентах и автономных задачах.
- 1
1. Повторяйте с экспоненциальной задержкой
Повторяйте запрос с экспоненциально растущей задержкой и случайным разбросом. Официальные SDK уже дважды повторяют ответы 5xx по умолчанию; увеличьте параметр максимального числа повторов клиента, а не добавляйте второй слой повторов вокруг него. Иначе количество попыток умножится, а не увеличится.
- 2
3. Перед эскалацией проверьте страницу статуса
Проверьте на status.claude.com, опубликован ли инцидент. В других конфигурациях проверьте хост провайдера или шлюза, указанный в сообщении об ошибке. Если ошибки продолжаются, а опубликованного инцидента нет, создайте обращение в поддержку и приложите request_id из тела ошибки.
- 3
2. Не повторяйте сразу и синхронно
Плотный цикл повторов усугубляет нехватку мощности и без пользы расходует ваш лимит запросов в минуту. Добавьте случайный разброс задержки, чтобы парк воркеров не синхронизировал повторные запросы в эффект «громовой толпы» против уже перегруженной модели.
- 4
4. Переключитесь на другую модель самостоятельно
Поскольку вычислительная мощность учитывается для каждой модели отдельно, маршрутизация на claude-opus-5 обычно позволяет получить ответ во время нехватки мощности Fable 5. Это нужно реализовать в коде: параметр fallbacks срабатывает только при отклонении запроса классификатором безопасности, но не при перегрузке.
- 5
5. В Claude Code увеличьте бюджет повторов для автономных запусков
Claude Code уже повторяет временные сбои до 10 раз с экспоненциальной задержкой; этим управляет CLAUDE_CODE_MAX_RETRIES. Для задач CI и тестовых harness задайте CLAUDE_CODE_RETRY_WATCHDOG равным 1, чтобы ошибки нехватки мощности 429 и 529 повторялись бесконечно, а не завершали запуск с ошибкой.
Сначала исключите лимит запросов
Если вы получаете 429, а не 529, способ исправления совершенно другой и зависит от вас. Прежде чем настраивать задержки, проверьте, какой код приходит.