Иллюстрированный разбор · 13 скриншотов

Лимиты Claude Code: как снизить стоимость каждой задачи

Когда лимит плана заканчивается быстрее ожидаемого, главный рычаг — какая модель выполняет работу. Этот разбор показывает реальную сессию Claude Code, где Sonnet 4.6 остаётся исполнителем, а Opus 4.6 вызывается только тогда, когда задаче нужно более сильное суждение.

The Claude Code advisor walkthrough opens on a title card promising near Opus-level intelligence at a fraction of the cost by pairing Opus as an advisor with Sonnet or Haiku as an executor
Вся стратегия на одной карточке: дешёвая модель работает каждый ход, дорогая вызывается только по необходимости.

Около 5 мин · 13 шагов, каждый ведёт на точную секунду исходного видео

Коротко

План съедают дорогие ходы, а не количество введённых запросов. В этом видео автор подключает модель-советника к исполнителю Sonnet: /advisor назначает Opus 4.6 консультантом, работающим на стороне сервера, /model opusplan — более старый вариант «одна модель за раз», а график SWE-bench Multilingual, который разбирается в видео, ставит Sonnet 4.6 High с советником Opus на 74.8% при $0.96 за agentic-задачу против 72.1% при $1.09 у Sonnet 4.6 High в одиночку. Та же схема доступна через Message API, а Monitor Tool от Anthropic следит за проблемами в фоне и тратит токены только при срабатывании.

Об исходном видео

Все скриншоты на этой странице взяты из трёхминутного разбора команды advisor от «Software Engineer Meets AI»: реальная сессия в VS Code в репозитории alldevneeds, Claude Code v2.1.104, Sonnet 4.6 и план Claude Pro.

Кадры используются с указанием источника, и каждый шаг ведёт на точную секунду исходного видео. Цены моделей, цифры бенчмарков и вывод команд — это содержимое экрана самого видео; перед действиями сверяйтесь с актуальной документацией Anthropic.

Три рычага в одной сессии

Прежде чем сокращать счёт, разберитесь, что чем управляет.

  1. 1

    Стратегия в одну строку

    Карточка в начале видео формулирует сделку одним предложением: поставьте Opus советником, а Sonnet или Haiku исполнителем — и получите почти интеллект Opus за долю стоимости. Всё остальное видео — эта фраза, подключённая к реальной сессии.

    Advisor strategy explainer card from the Claude Code video reading Pair Opus as an advisor with Sonnet or Haiku as an executor to get near Opus-level intelligence at a fraction of the cost
    Почти уровень Opus, но платите только тогда, когда он нужен.Смотреть с 0:08
  2. 2

    Sonnet 4.6 открывает сессию с нулевым контекстом

    Сессия начинается на Sonnet 4.6 в плане Claude Pro, а строка состояния показывает ctx 0%, потому что ещё ничего не отправлено. Sonnet — исполнитель, он обрабатывает ходы, а советник остаётся моделью в резерве.

    A fresh Claude Code session in the VS Code terminal on the alldevneeds repo showing Claude Code v2.1.104, Sonnet 4.6 on a Claude Pro plan, and a ctx 0% status line before a single prompt is sent
    Claude Code v2.1.104 в VS Code: Sonnet 4.6, Claude Pro, ctx 0%.Смотреть с 0:16
  3. 3

    Четыре команды, влияющие на счёт

    Ввод /model открывает список команд, и четыре пункта важны для стоимости: /model задаёт модель ИИ (здесь показан Sonnet 4.6), /effort задаёт уровень effort для модели, /advisor настраивает инструмент советника, а /status показывает версию, модель, аккаунт и подключение к API.

    Claude Code slash command menu listing /model set the AI model for Claude Code currently Sonnet 4.6, /effort set effort level for model usage, /advisor consult a stronger model at key moments, and /status for version model account and API connectivity
    В одном списке — модель, уровень effort и советник.Смотреть с 0:49

Подключение советника

Слэш-команда, панель выбора и подтверждение — меньше минуты.

  1. 4

    Введите команду советника

    /advisor — точка входа. Его описание на экране формулирует правило, на котором держится вся страница: обращаться к более сильной модели за руководством в ключевые моменты задачи. Сильная модель не приглашается на каждый ход.

    Claude Code prompt box with /advisor typed and the inline description Configure the Advisor Tool to consult a stronger model for guidance at key moments during a task
    «Настроить инструмент советника, чтобы обращаться к более сильной модели в ключевые моменты задачи».Смотреть с 0:24
  2. 5

    Выберите, какая модель советует

    Панель прямо говорит о стоимости: советник работает на стороне сервера и расходует дополнительные токены, а связка Sonnet как основной модели с Opus как советником даёт производительность около Opus при меньшем расходе. Предложены три варианта — Opus 4.6, Sonnet 4.6 и No advisor, причём до изменения отмечен No advisor.

    Claude Code Advisor Tool panel explaining that the advisor runs server-side and uses additional tokens, listing three choices Opus 4.6, Sonnet 4.6 and No advisor with No advisor currently checked
    Три варианта и предупреждение: советник расходует дополнительные токены.Смотреть с 0:32
  3. 6

    Советник закреплён как Opus 4.6

    После подтверждения под командой остаётся строка Advisor set to Opus 4.6. Поле ввода рядом всё ещё пустое, а строка состояния по-прежнему показывает ctx 0%: ничего ещё не потрачено, и исполнителем остаётся Sonnet 4.6.

    The Claude Code terminal confirming Advisor set to Opus 4.6 under the /advisor command with an empty prompt and a Sonnet 4.6 status line still reading ctx 0%
    «Advisor set to Opus 4.6» — схема готова до первого запроса.Смотреть с 0:40

Советник против старой схемы Opus plan

Два способа использовать сильную модель, не платя за неё каждый ход.

  1. 7

    Правило, по которому работала старая схема

    Крупная надпись называет привычку, которую заменяет советник: планирование — на Opus, исполнение — на Sonnet. Это одна модель за раз, переключаемая вручную, и следующий кадр показывает разницу.

    The Claude Code terminal at ctx 0% on Sonnet 4.6 under large white overlay text reading Planning to Opus and Executing to Sonnet, the split the creator used before the advisor command existed
    Планирование → Opus, исполнение → Sonnet: сильная модель думает, дешёвая печатает.Смотреть с 0:47
  2. 8

    Две схемы рядом

    Оба результата стоят в одном терминале. /advisor сообщает Advisor set to Opus 4.6, а /model opusplan — Set model to Opus 4.6 in plan mode, else Sonnet 4.6. По объяснению из видео, схема с советником позволяет исполнителю вызвать советника посреди задачи и делит общий контекст, тогда как Opus plan даёт одну модель за раз.

    Two Claude Code command results stacked in one terminal, Advisor set to Opus 4.6 from the advisor command above Set model to Opus 4.6 in plan mode else Sonnet 4.6 from the /model opusplan command
    Два результата команд, один вопрос: что расходует меньше токенов при том же результате?Смотреть с 0:56

Как работает разделение

Один общий контекст, две модели и вызов инструмента между ними.

  1. 9

    Исполнитель каждый ход, советник по требованию

    Схема делает роли конкретными. Executor — это Sonnet, он работает каждый ход в основном цикле; Advisor — это Opus, к которому ведёт вызов инструмента, по требованию. Советник не выдаёт ничего для пользователя, он только возвращает руководство исполнителю.

    How it works slide diagramming the advisor strategy with an Executor box labelled Sonnet runs every turn calling an Advisor box labelled Opus on demand through a tool call
    Sonnet в основном цикле, Opus за вызовом инструмента.Смотреть с 1:12
  2. 10

    Почему две модели делят один контекст

    Обведённый блок и есть суть функции: Executor читает и пишет общий Shared context из переписки, инструментов и истории, а Advisor просматривает тот же контекст и отправляет совет обратно, поэтому при передаче не нужно заново объяснять задачу.

    The advisor strategy diagram with the Shared context box circled in red, where the Executor reads and writes conversation tools and history while the Advisor reviews that context and sends advice back
    Общий контекст, обведённый в видео: советник видит то же, что исполнитель.Смотреть с 1:28

Что показывает график из видео

Выше результат, ниже стоимость задачи — и та же схема в API.

  1. 11

    Больше результата при меньшей цене задачи

    Это график SWE-bench Multilingual из самого видео, по оси X — стоимость одной agentic-задачи. Sonnet 4.6 High с советником Opus даёт 74.8% при $0.96, а Sonnet 4.6 High в одиночку — 72.1% при $1.09. Автор читает это как примерно три пункта больше при примерно двенадцати процентах меньше и говорит об этом в озвучке.

    SWE-bench Multilingual scatter chart plotting Sonnet 4.6 High plus Opus advisor at 74.8 percent for 0.96 dollars per agentic task against Sonnet 4.6 High solo at 72.1 percent for 1.09 dollars
    74.8% при $0.96 против 72.1% при $1.09 — это график из видео, а не наш замер.Смотреть с 2:00
  2. 12

    Та же схема в Message API

    Стратегия не только для Claude Code. В примере Message API исполнитель — это model: “claude-sonnet-4-6”, а советник приходит записью инструмента со значениями type “advisor_20260301”, name “advisor”, model “claude-opus-4-6” и max_uses 3. Комментарий под кодом объясняет, зачем следить за счётчиком: токены советника отражаются в блоке usage отдельно.

    Message API example code block with model claude-sonnet-4-6 marked executor and a tools entry typed advisor_20260301 named advisor on claude-opus-4-6 with max_uses 3, noting advisor tokens are reported separately in the usage block
    Токены советника указываются отдельно — блок usage оставляет их видимыми.Смотреть с 2:20

Следите за счётчиком

Фоновые наблюдатели тоже тратят токены.

  1. 13

    Наблюдатель тоже не бесплатный

    Видео завершается слайдом Monitor Tool от Anthropic. Инструмент следит за чем-то в фоне и реагирует на изменения, не прерывая основной диалог, а таблица сравнения прямо говорит о цене: Monitor Tool расходует токены при срабатывании, тогда как /loop — при каждом запуске.

    Claude Code Monitor Tool slide with a Monitor Tool versus /loop table showing the monitor consumes tokens when triggered while the loop command consumes tokens with every execution
    Monitor Tool против /loop: токены при срабатывании или при каждом запуске.Смотреть с 2:32

Частые вопросы о контроле расходов в Claude Code