Вайбцех

Как контролировать лимиты Claude Code в 2026: 7 шагов таблицы расходов

Опубликовано 15 мин чтенияБазовый
Автор с приложенного фото показывает схему контекста Claude Code, рядом кот в тревоге.
Что узнаете
  • таблицу полей для учёта задач, токенов, стоимости и лимитов
  • команды /usage, /cost, /status, /context, /clear и /compact с назначением
  • схему различий между подпиской, API-ключом, Pro, Max и Team
  • пороги для предупреждения, сокращения расхода, подтверждения credits и остановки
Применить за 30 мин
Базовый
5просмотров
Что в инструкции
  1. Что именно Claude Code считает токенами?
  2. Сколько стоит Claude Code и почему сумма меняется?
  3. Где посмотреть расход Claude Code?
  4. Какие тарифы и лимиты есть у Claude Code?
  5. Почему короткая команда иногда расходует много токенов?
  6. Как размер контекста ограничивает работу Claude Code?
  7. Как пошагово вести таблицу расходов Claude Code?
  8. Общие ли лимиты у Claude и Claude Code?
  9. Что делать, если лимит сгорает слишком быстро?
  10. Вопросы и ответы

Что именно Claude Code считает токенами?

Мужчина прикрывает лицо рядом со схемой истории, файлов и вызовов инструментов.

Claude Code работает через API-токены. Пользовательская команда составляет только часть передаваемого контекста. Остальное агент собирает сам во время работы.

В новый ход могут попасть:

  • предыдущие сообщения сессии;
  • CLAUDE.md и другие инструкции проекта;
  • файлы, которые Claude уже прочитал;
  • выводы Bash и других инструментов;
  • результаты поиска по проекту;
  • новый текст команды;
  • thinking tokens, если модель использует дополнительное рассуждение.

Anthropic описывает это правило прямо:

Каждый ход отправляет модели три вещи: историю разговора, контекст проекта и новый запрос.

- Anthropic, Models, usage, and limits in Claude Code

Отсюда первая ловушка. Ты пишешь: «исправь кнопку». Claude может прочитать несколько связанных файлов, проверить стили, вызвать поиск, открыть тесты и повторить всё это на следующем ходу. В сообщении пять слов. В переданном контексте намного больше.

CLAUDE.md тоже входит в контекст. Удобно держать там постоянные правила проекта, но длинный файл добавляет расход на сессии. Инструкции не заменяют механический контроль. Если агент должен остановиться перед опасным действием, текста правила недостаточно.

Сколько стоит Claude Code и почему сумма меняется?

Запрос «claude code стоимость» нельзя свести к цене одного сообщения. Сначала Claude Code передаёт контекст. Потом модель отвечает. В процессе агент может сделать дополнительные вызовы инструментов и повторно отправить историю.

Anthropic формулирует ограничение так:

Claude Code считает сумму в долларах локально по количеству токенов и стандартным list rates, поэтому она не учитывает промо-цены или договорные скидки и может отличаться от фактического счёта.

- Anthropic, Manage costs effectively

Поэтому в учёте нужны две разные колонки:

  • локальная оценка Claude Code;
  • фактический счёт в Console, если работа идёт через API.

На сумму влияют:

  • выбранная модель;
  • размер проекта;
  • длина истории;
  • количество прочитанных файлов;
  • вызовы инструментов;
  • thinking tokens;
  • несколько параллельных сессий;
  • автоматизация;
  • кэширование и способ авторизации.

Одна и та же задача на Sonnet и Opus не обязана стоить одинаково. Короткая команда в новом проекте и такая же команда после долгой отладки тоже дают разный контекст.

Anthropic отдельно предупреждает:

Расходы на одного разработчика сильно различаются в зависимости от выбора модели, размера кодовой базы и сценария использования, например нескольких экземпляров или автоматизации.

- Anthropic, Manage costs effectively

Считай /cost контрольной оценкой во время работы. Для API сверяй её с Claude Console. При API-авторизации используй данные Console, для Pro, Max и Team отдельно отслеживай лимит подписки. Эти показатели в одну строку не смешивай.

Где посмотреть расход Claude Code?

Используй команды по назначению:

/usage

Лимиты плана, время сброса и блок Session с данными текущей сессии отображаются в этой команде.

/cost

Токены и долларовую оценку текущей сессии при работе через API key показывает эта команда.

/status

Состояние авторизации и активный credential можно проверить через эту команду.

/context

Команда помогает увидеть, что занимает контекст: история, файлы, инструкции или инструменты.

Команды не дают одну универсальную цифру для всех способов оплаты. /cost относится к API billing. /usage полезен для лимитов подписки и данных сессии. Console нужен для сверки фактического счёта API.

Anthropic предупреждает про переменную окружения:

Случайно оставшийся ANTHROPIC_API_KEY может направить запросы через недорогой ключ вместо подписки.

- Anthropic, Error reference

Перед дорогой задачей проверь /status. Если активен не тот способ авторизации, таблица расходов быстро станет бесполезной.

Минимальный набор записи после работы:

Что записатьОткуда взять
Лимит и сброс/usage
Токены сессии/usage или /cost
Оценка API-расхода/cost
Авторизация/status
Размер контекста/context
Фактический API-счётConsole

Какие тарифы и лимиты есть у Claude Code?

Вопрос «claude code тарифы» нельзя честно закрыть таблицей абсолютных токенов, но бюджет подписки и безопасные остановки помогают не слить деньги. Anthropic не публикует в собранной фактуре точные значения Pro, Max и Team в токенах.

Что подтверждено:

План или местоЧто известно
ProОбщий лимит Claude и Claude Code
Max 5x5x использования за сессию относительно Pro
Max 20x20x использования за сессию относительно Pro
Team Standard1,25x использования за сессию относительно Pro
Team Premium6,25x использования за сессию относительно Pro

У Max есть два недельных ограничения:

  • одно действует на все модели;
  • второе относится только к Sonnet.

Следующее время сброса смотри в Settings > Usage. Для каждого участника Team действует собственный лимит. Общей квотой организации он не заменяется.

Anthropic описывает Team так:

Лимиты использования в Team применяются к каждому участнику, а не ко всей команде целиком.

- Anthropic, What is the Team plan?

После достижения включённого объёма для Pro и Max остаются два сценария:

  • дождаться сброса;
  • включить usage credits и продолжить за дополнительную оплату.

Для credits можно задать месячный spend cap и предупреждения. Авто-пополнение настраивается отдельно. Для Team владелец может задать общий лимит организации и отдельный лимит каждому участнику.

Абсолютных лимитов в токенах в этой статье нет. Anthropic описывает планы относительными множителями, окнами сброса и предупреждениями. Точного публичного числа, после которого Pro или Max остановится, в фактуре нет.

Claude Code и Claude используют общий лимит. Поэтому параллельный чат в Claude.ai тоже влияет на доступный объём подписки.

В этой точке полезно различать четыре сущности:

  • тариф подписки;
  • лимит подписки;
  • usage credits;
  • API-биллинг.

Они связаны, но не равны друг другу.

Понять расход мало. На практикуме я показываю руками, как собирать рабочий контроль: ограничивать контекст, проверять авторизацию, фиксировать сессии и ставить остановку до того, как агент перепишет полпроекта.

Практикум «Старт»

Три дня живой практики: от идеи до работающего проекта по ссылке

2 000 ₽старт 5 августа, 18:00 МСК

Почему короткая команда иногда расходует много токенов?

Фраза «исправь ошибку» ничего не говорит о размере работы. Claude Code сам определяет, какие файлы прочитать, какие команды вызвать и какие результаты добавить в следующий ход.

Anthropic объясняет:

Каждое предыдущее сообщение отправляется заново на каждом ходу, поэтому сессия, которая прошла через три несвязанные проблемы, оплачивает все три на каждом новом сообщении.

- Anthropic, Models, usage, and limits in Claude Code

К расходу добавляются:

  • длинная история;
  • повторное чтение больших файлов;
  • выводы Bash;
  • схемы MCP-инструментов;
  • ответы subagents;
  • thinking tokens;
  • параллельные процессы;
  • автоматизация.

Если задача закончилась, не продолжай ту же сессию по привычке. Для новой темы используй:

/clear

Если текущая задача продолжается, но история разрослась:

/compact

Сначала проверь источник:

/context

MCP тоже требует отдельного внимания. Подключённые инструменты могут добавлять описания и результаты в контекст. Для текущей задачи отключай ненужные MCP-серверы.

Для повторяемых задач удобно дать Claude Code короткий промпт с ограничением области:

Ограничение области и контроль расхода
Работай только с файлами, которые нужны для этой задачи.

Перед чтением:
1. Назови задачу одним предложением.
2. Перечисли каталоги и файлы, которые собираешься открыть.
3. Не сканируй весь репозиторий без моего подтверждения.
4. Сначала предложи короткий план.
5. После чтения файлов остановись и дождись подтверждения перед изменениями.
6. Если контекст заметно растёт, сообщи причину и предложи /compact или новую сессию.

Это не механический лимит. Промпт не остановит агент гарантированно. Он снижает риск бесконтрольного исследования и даёт точку, в которой можно нажать Esc.

Как размер контекста ограничивает работу Claude Code?

Контекстный лимит и тарифный лимит - разные ограничения.

Тарифный лимит отвечает на вопрос, сколько использования доступно плану или источнику биллинга. Контекстный лимит показывает, сколько данных помещается в один рабочий ход.

В статусной строке Claude Code указаны такие значения:

  • 200 000 токенов по умолчанию;
  • 1 000 000 токенов для моделей с расширенным контекстом.

При приближении к границе Claude Code управляет контекстом автоматически:

  1. очищает старые выводы инструментов;
  2. сжимает историю разговора;
  3. продолжает работу с более компактным представлением.

Автоматическое сжатие не отменяет расход. Оно только помогает продолжить сессию, когда исходная история уже не помещается целиком.

Для диагностики используй:

/context

Команда помогает увидеть, что занимает пространство. Если большую часть занимают файлы или tool calls, сокращай область работы. Если место занимает старая история, используй /compact или начни новую сессию через /clear.

Большое контекстное окно не означает безлимитную подписку. Claude Code может вместить больше данных, но обработка такого объёма всё равно влияет на расход.

Как пошагово вести таблицу расходов Claude Code?

Кот поднимает лапу рядом с карточками команд контроля расхода.
  1. Зафиксируй задачу и проект.

    Запиши одну конкретную задачу и рабочую папку.

    Не пиши «поработать над сайтом». Запиши «изменить текст кнопки на главной странице». Рядом укажи проект или репозиторий. Так позже станет понятно, что именно вызвало расход.

    Дата:
    Задача:
    Проект:
    Размер задачи: S / M / L
  2. Проверь лимит и авторизацию.

    Выполни /usage и /status до начала работы.

    Запиши доступный объём, время сброса и активный способ входа. Если в окружении остался ANTHROPIC_API_KEY, проверь, не ушла ли сессия через API вместо Pro, Max или Team.

    /usage
    /status
  3. Запиши модель и сессию.

    Укажи выбранную модель и реши, начинаешь ли новую сессию.

    Для новой независимой задачи не продолжай старую историю. Если работа связана с предыдущей, отметь это явно. Рядом запиши /context до первого действия.

    /context
  4. Сними показатели после работы.

    После завершения задачи снова выполни /usage или /cost.

    Для API key основной командой будет /cost. Данные сессии и лимита для подписки смотри через /usage. Если нужен точный API-биллинг, проверь Console отдельно.

    /usage
    /cost
  5. Отметь причину роста.

    Выбери причину из наблюдаемых факторов.

    Подойдут значения «длинная история», «большой проект», «MCP», «много tool calls», «Opus», «thinking tokens», «параллельные процессы» или «автоматизация». Не оставляй причину пустой: без неё цифра не помогает принять решение.

  6. Зафиксируй результат и действие.

    Запиши, изменился ли код и что делать дальше.

    Если токены выросли, а изменённых строк нет, остановись и разбери сессию. Следующим действием может быть /compact, /clear, смена модели, отключение MCP или ожидание сброса.

    Таблица может выглядеть так:

    ПолеЗначение
    Дата и задачаЧто делалось
    ПроектРепозиторий или папка
    МодельSonnet, Opus, Haiku или другая
    АвторизацияPro, Max, Team, API key, Bedrock, Vertex, Foundry
    СессияНовая или продолжение
    Команды контроля/usage, /cost, /status, /context
    ТокеныЗначение из Claude Code или Console
    Оценочная стоимостьЗначение /usage или /cost
    ЛимитСессионный, недельный, месячный или организационный
    Следующий сбросЗначение из /usage или Settings > Usage
    Причина ростаКонтекст, история, модель, MCP, агенты или автоматизация
    ИтогСделано, продолжить позже или остановить
  7. Поставь четыре порога.

    Используй последовательность от наблюдения к остановке.

    • Предупреждение: расход или лимит заметно растёт.
    • Снижение расхода: запусти /context, затем используй /compact, /clear или смени модель.
    • Подтверждение: включай usage credits только для задачи, которую действительно нужно продолжить.
    • Остановка: не запускай новую дорогую цепочку до сброса или пересмотра бюджета.

    Это редакционная схема контроля. Anthropic не публикует абсолютные лимиты, которые соответствовали бы этим порогам.

Общие ли лимиты у Claude и Claude Code?

Anthropic прямо пишет:

Планы Pro и Max используют общие лимиты между Claude и Claude Code, поэтому активность в обоих инструментах считается вместе.

- Anthropic, Use Claude Code with your Pro or Max plan

Если параллельно вести длинный разговор в Claude.ai и запускать Claude Code, доступный объём уменьшается быстрее. В таблице не хватит поля «Claude Code». Добавь источник использования:

ДатаПоверхностьАвторизацияЛимитРасход
2026-08-14Claude CodeProОбщий...
2026-08-14Claude.aiProОбщий...
2026-08-14Claude CodeAPI keyConsole...
2026-08-14Claude CodeBedrockAWS...
2026-08-14Claude CodeVertexGoogle Cloud...
2026-08-14Claude CodeFoundryMicrosoft...

Общие лимиты относятся к Pro и Max. Team ведёт лимит по участникам. API key нужно держать отдельно от подписочного объёма: он относится к API-биллингу. Bedrock, Vertex и Foundry тоже контролируются через собственные облачные источники и консоли.

Платные планы используют usage credits для Claude и Claude Code:

Usage credits применяются к разговорам Claude и терминальному использованию Claude Code. Совокупное использование в обоих интерфейсах учитывается вместе.

- Anthropic, Manage usage credits for paid Claude plans

Поэтому в таблице нужны две пары полей: «тип авторизации» и «источник биллинга».

Практикум «Старт»

Три дня живой практики: от идеи до работающего проекта по ссылке

2 000 ₽старт 5 августа, 18:00 МСК

Что делать, если лимит сгорает слишком быстро?

Собака в шоке смотрит на карточки с огромным расходом и нулевым результатом.

Это крайний случай, но он хорошо показывает порядок диагностики. Большой расход без результата нужно считать аварийным событием.

Проверь по порядку:

  1. Был ли огромный контекст;
  2. Не зациклились ли tool calls;
  3. Не запускались ли параллельные процессы;
  4. Не загружены ли ненужные MCP;
  5. Не повторяется ли старая история;
  6. Не использовалась ли дорогая модель без причины;
  7. Есть ли изменённые строки;
  8. Совпадает ли локальная оценка с источником биллинга.

В том запуске за 6 минут 32 секунды было обработано 10 263 334 токена. Claude Code сделал 15 вызовов модели, 8 Bash-вызовов и 7 чтений файлов. Код не изменился. Автор оценил API-equivalent стоимость примерно в $109.07, из которых $103.79 пришлись на записи кэша.

Цифры относятся к конкретному пользовательскому разбору. Они не описывают гарантированное поведение Claude Code. Но последовательность проверки универсальна:

  1. Нажми Esc, если цепочка продолжает работать.
  2. Сними /usage и /cost.
  3. Проверь /context.
  4. Посмотри число model calls и tool calls в логах.
  5. Проверь cache read и cache write.
  6. Запиши, изменился ли код.
  7. Отдельно проверь параллельные сессии и автоматизацию.
  8. После этого реши, продолжать ли работу.

Если код не меняется, а токены продолжают расти, не жди ещё одного цикла «на всякий случай». Сначала останови процесс.

Переход на Haiku внутри Claude Code тоже не гарантирует освобождение подписочного лимита. Более дешёвая модель может всё равно расходовать общую квоту Anthropic. Внешний API с отдельным бюджетом и дешёвая модель внутри Claude Code - разные способы контроля.

В таблицу аварийного случая добавь:

ПолеЧто записать
Время работы6 минут 32 секунды
Обработано токенов10 263 334
Model calls15
Bash calls8
Чтения файлов7
Изменённые строки0
API-equivalentОколо $109.07
Cache writesОколо $103.79
Следующее действиеОстановить и разобрать логи

Не переноси эти значения на каждую сессию. Используй их как образец полей для диагностики.

Вопросы и ответы

Вопросы и ответы

Какие лимиты у Claude Code?

Claude Code работает в рамках лимитов выбранного плана или источника авторизации. Для Pro и Max лимиты Claude и Claude Code общие. У Max есть общий недельный лимит и отдельный недельный лимит для Sonnet. Абсолютные значения в токенах зависят от текущей политики Anthropic и не подтверждены в фактуре.

Какие лимиты shared with Claude Code?

Лимиты Claude и Claude Code shared для Pro и Max. Активность в Claude.ai и Claude Code считается вместе. API key, Bedrock, Vertex и Foundry учитываются отдельно через собственные источники биллинга, поэтому в таблице нужно фиксировать способ авторизации.

Какие бывают Claude Code plans?

В фактуре подтверждены Pro, Max 5x, Max 20x и Team с местами Standard и Premium. Pro служит базовым уровнем сравнения. Max 5x и Max 20x дают относительное увеличение объёма сессии. Team Standard и Premium имеют собственные относительные множители и лимиты по участникам.

Сколько стоит Claude Code?

Claude Code связывает стоимость с API-токенами. Команды /usage и /cost показывают локальную оценку по стандартным list rates. Она может отличаться от фактического API-счёта из-за модели, кэширования, скидок, условий договора и способа авторизации. Для сверки API используй Claude Console.

Что входит в Claude Code Pro и какие у него ограничения?

Pro даёт общий лимит для Claude и Claude Code. После достижения включённого объёма можно дождаться сброса или включить usage credits. Anthropic не публикует в собранной фактуре абсолютный лимит Pro в токенах, поэтому точное число нельзя честно назвать.

Чем Claude Code Max отличается от Pro?

Max 5x предоставляет в пять раз больше использования за сессию относительно Pro, а Max 20x - в двадцать раз больше. У Max также есть два недельных ограничения: одно для всех моделей и отдельное для Sonnet. Эти значения выражены относительными множителями, фиксированного числа токенов здесь нет.

Как Claude Code считает токены?

В расход попадают новый запрос, история сессии, CLAUDE.md, прочитанные файлы, результаты инструментов, MCP-контекст и thinking tokens. Каждый новый ход повторно отправляет историю и проектный контекст. Поэтому длина команды не показывает полный объём обработки.

Как Claude Code контекст влияет на расход?

Чем больше контекста Claude Code обрабатывает, тем больше токенов уходит на ход. Контекстное окно составляет 200 000 токенов по умолчанию и 1 000 000 для поддерживаемых моделей с расширенным контекстом. /context показывает, какие данные занимают окно.

Сколько стоит подписка Claude Code Pro?

В этой статье не фиксируется цена подписки Pro, потому что фактура раздела посвящена лимитам, токенам и биллингу, а не актуальной тарифной карточке. Для расхода важнее различать стоимость подписки, общий лимит Pro и дополнительные usage credits.

От чего зависит цена Claude Code?

Цена зависит от модели, размера проекта, длины истории, прочитанных файлов, вызовов инструментов, thinking tokens, параллельных сессий и автоматизации. При API-авторизации локальная оценка /cost может отличаться от фактического счёта в Console.

Какие ограничения могут остановить Claude Code?

Работу могут остановить контекстное окно, сессионный лимит, недельный лимит, общий лимит подписки, spend limit или остановка usage credits. При достижении контекстной границы Claude Code может сжать историю, но это не отменяет тарифные ограничения.

Что выбрать для больших объёмов: Claude Code Pro или Max?

Pro подходит для меньшего объёма работы, если общий лимит и сброс закрывают задачи. Max даёт относительное увеличение сессионного объёма, но не устраняет расход от большого контекста, параллельных процессов и автоматизации. Перед переходом на Max сначала проверь /usage, /context и причины роста.

Источники

Практикум «Старт»

Три дня живой практики: от идеи до работающего проекта по ссылке

2 000 ₽старт 5 августа, 18:00 МСК

Материал был полезен?
Сергей Мазур
Автор
Сергей Мазур
Основатель Вайбцеха

Собираю продукты с ИИ-агентами и рассказываю, как это делать без программиста.

Читайте также

Вайб-кодинг: 9 шагов до сайта, который не выглядит сгенерированным

Вайб-кодинг помогает собрать сайт через описание задачи и последовательные правки обычным языком. Показываю, как удержать собственный визуальный замысел и не получить типовой AI-дизайн.

16 мин

Claude модели: как выбрать режим мышления агента в 2026 году

Claude - это линейка моделей с разной скоростью, стоимостью и глубиной работы. Разбираю, какую модель и какой режим выбрать для простого фикса, сложного бага или длинной агентной задачи.

19 мин

Claude Code через Git: 7 шагов в 2026 году для передачи контекста между сессиями

Claude Code не переносит историю чата одним сообщением. Показываю, как связать resume, Git, файлы состояния и короткий handoff.

12 мин

Приложение без кода: 8 шагов до работающего экрана в iOS Simulator

Приложение без кода можно собрать как локальный iOS-прототип. Ниже я показываю связку Mac, Xcode, Claude Code и Simulator.

10 мин

Термины из инструкции