Иллюстрированный разбор · 13 скриншотов
Лимиты Claude Code: как снизить стоимость каждой задачи
Когда лимит плана заканчивается быстрее ожидаемого, главный рычаг — какая модель выполняет работу. Этот разбор показывает реальную сессию Claude Code, где Sonnet 4.6 остаётся исполнителем, а Opus 4.6 вызывается только тогда, когда задаче нужно более сильное суждение.

Около 5 мин · 13 шагов, каждый ведёт на точную секунду исходного видео
Коротко
План съедают дорогие ходы, а не количество введённых запросов. В этом видео автор подключает модель-советника к исполнителю Sonnet: /advisor назначает Opus 4.6 консультантом, работающим на стороне сервера, /model opusplan — более старый вариант «одна модель за раз», а график SWE-bench Multilingual, который разбирается в видео, ставит Sonnet 4.6 High с советником Opus на 74.8% при $0.96 за agentic-задачу против 72.1% при $1.09 у Sonnet 4.6 High в одиночку. Та же схема доступна через Message API, а Monitor Tool от Anthropic следит за проблемами в фоне и тратит токены только при срабатывании.
Об исходном видео
Все скриншоты на этой странице взяты из трёхминутного разбора команды advisor от «Software Engineer Meets AI»: реальная сессия в VS Code в репозитории alldevneeds, Claude Code v2.1.104, Sonnet 4.6 и план Claude Pro.
Кадры используются с указанием источника, и каждый шаг ведёт на точную секунду исходного видео. Цены моделей, цифры бенчмарков и вывод команд — это содержимое экрана самого видео; перед действиями сверяйтесь с актуальной документацией Anthropic.
Три рычага в одной сессии
Прежде чем сокращать счёт, разберитесь, что чем управляет.
- 1
Стратегия в одну строку
Карточка в начале видео формулирует сделку одним предложением: поставьте Opus советником, а Sonnet или Haiku исполнителем — и получите почти интеллект Opus за долю стоимости. Всё остальное видео — эта фраза, подключённая к реальной сессии.

Почти уровень Opus, но платите только тогда, когда он нужен.Смотреть с 0:08 - 2
Sonnet 4.6 открывает сессию с нулевым контекстом
Сессия начинается на Sonnet 4.6 в плане Claude Pro, а строка состояния показывает ctx 0%, потому что ещё ничего не отправлено. Sonnet — исполнитель, он обрабатывает ходы, а советник остаётся моделью в резерве.

Claude Code v2.1.104 в VS Code: Sonnet 4.6, Claude Pro, ctx 0%.Смотреть с 0:16 - 3
Четыре команды, влияющие на счёт
Ввод /model открывает список команд, и четыре пункта важны для стоимости: /model задаёт модель ИИ (здесь показан Sonnet 4.6), /effort задаёт уровень effort для модели, /advisor настраивает инструмент советника, а /status показывает версию, модель, аккаунт и подключение к API.

В одном списке — модель, уровень effort и советник.Смотреть с 0:49
Подключение советника
Слэш-команда, панель выбора и подтверждение — меньше минуты.
- 4
Введите команду советника
/advisor — точка входа. Его описание на экране формулирует правило, на котором держится вся страница: обращаться к более сильной модели за руководством в ключевые моменты задачи. Сильная модель не приглашается на каждый ход.

«Настроить инструмент советника, чтобы обращаться к более сильной модели в ключевые моменты задачи».Смотреть с 0:24 - 5
Выберите, какая модель советует
Панель прямо говорит о стоимости: советник работает на стороне сервера и расходует дополнительные токены, а связка Sonnet как основной модели с Opus как советником даёт производительность около Opus при меньшем расходе. Предложены три варианта — Opus 4.6, Sonnet 4.6 и No advisor, причём до изменения отмечен No advisor.

Три варианта и предупреждение: советник расходует дополнительные токены.Смотреть с 0:32 - 6
Советник закреплён как Opus 4.6
После подтверждения под командой остаётся строка Advisor set to Opus 4.6. Поле ввода рядом всё ещё пустое, а строка состояния по-прежнему показывает ctx 0%: ничего ещё не потрачено, и исполнителем остаётся Sonnet 4.6.

«Advisor set to Opus 4.6» — схема готова до первого запроса.Смотреть с 0:40
Советник против старой схемы Opus plan
Два способа использовать сильную модель, не платя за неё каждый ход.
- 7
Правило, по которому работала старая схема
Крупная надпись называет привычку, которую заменяет советник: планирование — на Opus, исполнение — на Sonnet. Это одна модель за раз, переключаемая вручную, и следующий кадр показывает разницу.

Планирование → Opus, исполнение → Sonnet: сильная модель думает, дешёвая печатает.Смотреть с 0:47 - 8
Две схемы рядом
Оба результата стоят в одном терминале. /advisor сообщает Advisor set to Opus 4.6, а /model opusplan — Set model to Opus 4.6 in plan mode, else Sonnet 4.6. По объяснению из видео, схема с советником позволяет исполнителю вызвать советника посреди задачи и делит общий контекст, тогда как Opus plan даёт одну модель за раз.

Два результата команд, один вопрос: что расходует меньше токенов при том же результате?Смотреть с 0:56
Как работает разделение
Один общий контекст, две модели и вызов инструмента между ними.
- 9
Исполнитель каждый ход, советник по требованию
Схема делает роли конкретными. Executor — это Sonnet, он работает каждый ход в основном цикле; Advisor — это Opus, к которому ведёт вызов инструмента, по требованию. Советник не выдаёт ничего для пользователя, он только возвращает руководство исполнителю.

Sonnet в основном цикле, Opus за вызовом инструмента.Смотреть с 1:12 - 10
Почему две модели делят один контекст
Обведённый блок и есть суть функции: Executor читает и пишет общий Shared context из переписки, инструментов и истории, а Advisor просматривает тот же контекст и отправляет совет обратно, поэтому при передаче не нужно заново объяснять задачу.

Общий контекст, обведённый в видео: советник видит то же, что исполнитель.Смотреть с 1:28
Что показывает график из видео
Выше результат, ниже стоимость задачи — и та же схема в API.
- 11
Больше результата при меньшей цене задачи
Это график SWE-bench Multilingual из самого видео, по оси X — стоимость одной agentic-задачи. Sonnet 4.6 High с советником Opus даёт 74.8% при $0.96, а Sonnet 4.6 High в одиночку — 72.1% при $1.09. Автор читает это как примерно три пункта больше при примерно двенадцати процентах меньше и говорит об этом в озвучке.

74.8% при $0.96 против 72.1% при $1.09 — это график из видео, а не наш замер.Смотреть с 2:00 - 12
Та же схема в Message API
Стратегия не только для Claude Code. В примере Message API исполнитель — это model: “claude-sonnet-4-6”, а советник приходит записью инструмента со значениями type “advisor_20260301”, name “advisor”, model “claude-opus-4-6” и max_uses 3. Комментарий под кодом объясняет, зачем следить за счётчиком: токены советника отражаются в блоке usage отдельно.

Токены советника указываются отдельно — блок usage оставляет их видимыми.Смотреть с 2:20
Следите за счётчиком
Фоновые наблюдатели тоже тратят токены.
- 13
Наблюдатель тоже не бесплатный
Видео завершается слайдом Monitor Tool от Anthropic. Инструмент следит за чем-то в фоне и реагирует на изменения, не прерывая основной диалог, а таблица сравнения прямо говорит о цене: Monitor Tool расходует токены при срабатывании, тогда как /loop — при каждом запуске.

Monitor Tool против /loop: токены при срабатывании или при каждом запуске.Смотреть с 2:32