# Как контролировать лимиты Claude Code в 2026: 7 шагов таблицы расходов

> Claude Code расходует не только текст команды. Разбираю токены, лимиты, стоимость, команды контроля и таблицу, которая показывает причину роста расхода.

Источник: https://vibeceh.ru/guides/tokeny-limity-i-schet-tablica-kontrolya-rashodov-claude-code
Автор: Сергей Мазур · опубликовано 2026-08-14

Claude Code легко принять за чат, где цена зависит от длины сообщения. На деле `claude code limits` зависят от контекста, истории, файлов и вызовов инструментов. В статье разбираю, что означает запрос «claude code токены», где смотреть расход, чем отличаются тарифы и почему короткая команда иногда сжигает большую часть доступного объёма.

## Что именно Claude Code считает токенами?

при запросе «claude code limits» помни: Claude Code считает не только текст команды. В расход попадают история текущей сессии, `CLAUDE.md`, прочитанные файлы, результаты вызовов инструментов и новый запрос. Каждый следующий ход снова отправляет накопленный контекст модели, поэтому короткая команда в длинной сессии может стоить заметно дороже отдельного запроса в чистом проекте.

![Мужчина прикрывает лицо рядом со схемой истории, файлов и вызовов инструментов.](https://s3.regru.cloud/crossmark/statejnik/images/guides/tokeny-limity-i-schet-tablica-kontrolya-rashodov-claude-code/kadr-1.webp)

Claude Code работает через [API-токены](/concepts/token). Пользовательская команда составляет только часть передаваемого контекста. Остальное агент собирает сам во время работы.

В новый ход могут попасть:

- предыдущие сообщения сессии;
- `CLAUDE.md` и другие инструкции проекта;
- файлы, которые Claude уже прочитал;
- выводы Bash и других инструментов;
- результаты поиска по проекту;
- новый текст команды;
- thinking tokens, если модель использует дополнительное рассуждение.

Anthropic описывает это правило прямо:

Каждый ход отправляет модели три вещи: историю разговора, контекст проекта и новый запрос.

Отсюда первая ловушка. Ты пишешь: «исправь кнопку». Claude может прочитать несколько связанных файлов, проверить стили, вызвать поиск, открыть тесты и повторить всё это на следующем ходу. В сообщении пять слов. В переданном контексте намного больше.

`CLAUDE.md` тоже входит в контекст. Удобно держать там постоянные правила проекта, но длинный файл добавляет расход на сессии. Инструкции не заменяют механический контроль. Если агент должен остановиться перед опасным действием, текста правила недостаточно.

## Сколько стоит Claude Code и почему сумма меняется?

Claude Code связывает стоимость с API-токенами, но цифра внутри `/usage` или `/cost` остаётся локальной оценкой по стандартным list rates. Фактическая сумма может отличаться от счёта в Console. На расход влияют модель, размер кодовой базы, длинные сессии, параллельные экземпляры, автоматизация, кэширование и способ авторизации.

Запрос «claude code стоимость» нельзя свести к цене одного сообщения. Сначала Claude Code передаёт контекст. Потом модель отвечает. В процессе агент может сделать дополнительные вызовы инструментов и повторно отправить историю.

Anthropic формулирует ограничение так:

Claude Code считает сумму в долларах локально по количеству токенов и стандартным list rates, поэтому она не учитывает промо-цены или договорные скидки и может отличаться от фактического счёта.

Поэтому в учёте нужны две разные колонки:

- локальная оценка Claude Code;
- фактический счёт в Console, если работа идёт через API.

На сумму влияют:

- выбранная модель;
- размер проекта;
- длина истории;
- количество прочитанных файлов;
- вызовы инструментов;
- thinking tokens;
- несколько параллельных сессий;
- автоматизация;
- кэширование и способ авторизации.

Одна и та же задача на Sonnet и Opus не обязана стоить одинаково. Короткая команда в новом проекте и такая же команда после долгой отладки тоже дают разный контекст.

Anthropic отдельно предупреждает:

Расходы на одного разработчика сильно различаются в зависимости от выбора модели, размера кодовой базы и сценария использования, например нескольких экземпляров или автоматизации.

Считай `/cost` контрольной оценкой во время работы. Для API сверяй её с Claude Console. При API-авторизации используй данные Console, для Pro, Max и Team отдельно отслеживай лимит подписки. Эти показатели в одну строку не смешивай.

Значение `/usage` или `/cost` может отличаться от фактической суммы. Записывай оба показателя и рядом фиксируй тип авторизации.

## Где посмотреть расход Claude Code?

Запрос «claude code usage» закрывают четыре команды и один внешний экран: `/usage`, `/cost`, `/status`, `/context` и Console Anthropic. `/usage` показывает лимиты, сброс и данные текущей сессии. Токены и оценку API-расхода показывает `/cost`. `/status` помогает проверить авторизацию. Для окончательной сверки API-биллинга открой Console Anthropic.

Используй команды по назначению:

```text
/usage
```

Лимиты плана, время сброса и блок Session с данными текущей сессии отображаются в этой команде.

```text
/cost
```

Токены и долларовую оценку текущей сессии при работе через API key показывает эта команда.

```text
/status
```

Состояние авторизации и активный credential можно проверить через эту команду.

```text
/context
```

Команда помогает увидеть, что занимает контекст: история, файлы, инструкции или инструменты.

Команды не дают одну универсальную цифру для всех способов оплаты. `/cost` относится к API billing. `/usage` полезен для лимитов подписки и данных сессии. Console нужен для сверки фактического счёта API.

Anthropic предупреждает про переменную окружения:

Случайно оставшийся `ANTHROPIC_API_KEY` может направить запросы через недорогой ключ вместо подписки.

Перед дорогой задачей проверь `/status`. Если активен не тот способ авторизации, таблица расходов быстро станет бесполезной.

Минимальный набор записи после работы:

| Что записать | Откуда взять |
|---|---|
| Лимит и сброс | `/usage` |
| Токены сессии | `/usage` или `/cost` |
| Оценка API-расхода | `/cost` |
| Авторизация | `/status` |
| Размер контекста | `/context` |
| Фактический API-счёт | Console |

## Какие тарифы и лимиты есть у Claude Code?

Pro и Max используют общие лимиты Claude и Claude Code. Max 5x даёт в пять раз больше использования за сессию относительно Pro, Max 20x - в двадцать раз больше. У Team лимит считается отдельно для каждого участника: Standard даёт 1,25x, Premium - 6,25x относительно Pro.

Вопрос «claude code тарифы» нельзя честно закрыть таблицей абсолютных токенов, но [бюджет подписки и безопасные остановки](/guides/claude-code-limity-podpiski-i-bezopasnyy-byudzhet-proekta) помогают не слить деньги. Anthropic не публикует в собранной фактуре точные значения Pro, Max и Team в токенах.

Что подтверждено:

| План или место | Что известно |
|---|---|
| Pro | Общий лимит Claude и Claude Code |
| Max 5x | 5x использования за сессию относительно Pro |
| Max 20x | 20x использования за сессию относительно Pro |
| Team Standard | 1,25x использования за сессию относительно Pro |
| Team Premium | 6,25x использования за сессию относительно Pro |

У Max есть два недельных ограничения:

- одно действует на все модели;
- второе относится только к Sonnet.

Следующее время сброса смотри в Settings > Usage. Для каждого участника Team действует собственный лимит. Общей квотой организации он не заменяется.

Anthropic описывает Team так:

Лимиты использования в Team применяются к каждому участнику, а не ко всей команде целиком.

После достижения включённого объёма для Pro и Max остаются два сценария:

- дождаться сброса;
- включить usage credits и продолжить за дополнительную оплату.

Для credits можно задать месячный spend cap и предупреждения. Авто-пополнение настраивается отдельно. Для Team владелец может задать общий лимит организации и отдельный лимит каждому участнику.

Абсолютных лимитов в токенах в этой статье нет. Anthropic описывает планы относительными множителями, окнами сброса и предупреждениями. Точного публичного числа, после которого Pro или Max остановится, в фактуре нет.

Claude Code и Claude используют общий лимит. Поэтому параллельный чат в Claude.ai тоже влияет на доступный объём подписки.

В этой точке полезно различать четыре сущности:

- тариф подписки;
- лимит подписки;
- usage credits;
- API-биллинг.

Они связаны, но не равны друг другу.

Понять расход мало. На практикуме я показываю руками, как собирать рабочий контроль: ограничивать контекст, проверять авторизацию, фиксировать сессии и ставить остановку до того, как агент перепишет полпроекта.

## Почему короткая команда иногда расходует много токенов?

Короткий запрос может оказаться дорогим из-за длинной истории, файлов, MCP, вызовов инструментов и thinking tokens. Каждый новый ход повторно отправляет прошлые сообщения и контекст проекта. `/clear` начинает чистую задачу, `/compact` сжимает текущую историю, а `/context` показывает главный источник роста.

Фраза «исправь ошибку» ничего не говорит о размере работы. Claude Code сам определяет, какие файлы прочитать, какие команды вызвать и какие результаты добавить в следующий ход.

Anthropic объясняет:

Каждое предыдущее сообщение отправляется заново на каждом ходу, поэтому сессия, которая прошла через три несвязанные проблемы, оплачивает все три на каждом новом сообщении.

К расходу добавляются:

- длинная история;
- повторное чтение больших файлов;
- выводы Bash;
- схемы MCP-инструментов;
- ответы subagents;
- thinking tokens;
- параллельные процессы;
- автоматизация.

Если задача закончилась, не продолжай ту же сессию по привычке. Для новой темы используй:

```text
/clear
```

Если текущая задача продолжается, но история разрослась:

```text
/compact
```

Сначала проверь источник:

```text
/context
```

MCP тоже требует отдельного внимания. Подключённые инструменты могут добавлять описания и результаты в контекст. Для текущей задачи отключай ненужные MCP-серверы.

Для повторяемых задач удобно дать Claude Code короткий промпт с ограничением области:

Это не механический лимит. Промпт не остановит агент гарантированно. Он снижает риск бесконтрольного исследования и даёт точку, в которой можно нажать `Esc`.

## Как размер контекста ограничивает работу Claude Code?

Стандартное [контекстное окно](/concepts/kontekst) Claude Code составляет 200 000 токенов. Для поддерживаемых моделей с расширенным контекстом доступно 1 000 000 токенов. При приближении к границе Claude Code автоматически очищает старые выводы инструментов и при необходимости сжимает историю. `/context` показывает, что заняло окно.

Контекстный лимит и тарифный лимит - разные ограничения.

Тарифный лимит отвечает на вопрос, сколько использования доступно плану или источнику биллинга. Контекстный лимит показывает, сколько данных помещается в один рабочий ход.

В статусной строке Claude Code указаны такие значения:

- 200 000 токенов по умолчанию;
- 1 000 000 токенов для моделей с расширенным контекстом.

При приближении к границе Claude Code управляет контекстом автоматически:

1. очищает старые выводы инструментов;
2. сжимает историю разговора;
3. продолжает работу с более компактным представлением.

Автоматическое сжатие не отменяет расход. Оно только помогает продолжить сессию, когда исходная история уже не помещается целиком.

Для диагностики используй:

```text
/context
```

Команда помогает увидеть, что занимает пространство. Если большую часть занимают файлы или tool calls, сокращай область работы. Если место занимает старая история, используй `/compact` или начни новую сессию через `/clear`.

Большое контекстное окно не означает безлимитную подписку. Claude Code может вместить больше данных, но обработка такого объёма всё равно влияет на расход.

## Как пошагово вести таблицу расходов Claude Code?

Таблица расходов начинается до запуска задачи. Зафиксируй задачу, проект и авторизацию, проверь `/usage` и `/status`, запиши модель и сессию, после работы сними `/usage` или `/cost`, а затем отметь причину роста, результат и следующее действие. Так расход связывается не только с токенами, но и с реальной работой.

![Кот поднимает лапу рядом с карточками команд контроля расхода.](https://s3.regru.cloud/crossmark/statejnik/images/guides/tokeny-limity-i-schet-tablica-kontrolya-rashodov-claude-code/kadr-2.webp)

Запиши одну конкретную задачу и рабочую папку.

Не пиши «поработать над сайтом». Запиши «изменить текст кнопки на главной странице». Рядом укажи проект или репозиторий. Так позже станет понятно, что именно вызвало расход.

   ```text
   Дата:
   Задача:
   Проект:
   Размер задачи: S / M / L
   ```

Выполни `/usage` и `/status` до начала работы.

Запиши доступный объём, время сброса и активный способ входа. Если в окружении остался `ANTHROPIC_API_KEY`, проверь, не ушла ли сессия через API вместо Pro, Max или Team.

   ```text
   /usage
   /status
   ```

Укажи выбранную модель и реши, начинаешь ли новую сессию.

Для новой независимой задачи не продолжай старую историю. Если работа связана с предыдущей, отметь это явно. Рядом запиши `/context` до первого действия.

   ```text
   /context
   ```

После завершения задачи снова выполни `/usage` или `/cost`.

Для API key основной командой будет `/cost`. Данные сессии и лимита для подписки смотри через `/usage`. Если нужен точный API-биллинг, проверь Console отдельно.

   ```text
   /usage
   /cost
   ```

Выбери причину из наблюдаемых факторов.

Подойдут значения «длинная история», «большой проект», «MCP», «много tool calls», «Opus», «thinking tokens», «параллельные процессы» или «автоматизация». Не оставляй причину пустой: без неё цифра не помогает принять решение.

Запиши, изменился ли код и что делать дальше.

Если токены выросли, а изменённых строк нет, остановись и разбери сессию. Следующим действием может быть `/compact`, `/clear`, смена модели, отключение MCP или ожидание сброса.

Таблица может выглядеть так:

| Поле | Значение |
|---|---|
| Дата и задача | Что делалось |
| Проект | Репозиторий или папка |
| Модель | Sonnet, Opus, Haiku или другая |
| Авторизация | Pro, Max, Team, API key, Bedrock, Vertex, Foundry |
| Сессия | Новая или продолжение |
| Команды контроля | `/usage`, `/cost`, `/status`, `/context` |
| Токены | Значение из Claude Code или Console |
| Оценочная стоимость | Значение `/usage` или `/cost` |
| Лимит | Сессионный, недельный, месячный или организационный |
| Следующий сброс | Значение из `/usage` или Settings > Usage |
| Причина роста | Контекст, история, модель, MCP, агенты или автоматизация |
| Итог | Сделано, продолжить позже или остановить |

Используй последовательность от наблюдения к остановке.

- **Предупреждение:** расход или лимит заметно растёт.
- **Снижение расхода:** запусти `/context`, затем используй `/compact`, `/clear` или смени модель.
- **Подтверждение:** включай usage credits только для задачи, которую действительно нужно продолжить.
- **Остановка:** не запускай новую дорогую цепочку до сброса или пересмотра бюджета.

Это редакционная схема контроля. Anthropic не публикует абсолютные лимиты, которые соответствовали бы этим порогам.

## Общие ли лимиты у Claude и Claude Code?

Для Pro и Max лимиты Claude и Claude Code общие. Веб-интерфейс, терминал и другие поверхности Claude расходуют один доступный объём подписки. При этом подписка, API key, Bedrock, Vertex и Foundry имеют отдельный учёт и разные источники биллинга, поэтому тип авторизации нужен в каждой строке таблицы.

Anthropic прямо пишет:

Планы Pro и Max используют общие лимиты между Claude и Claude Code, поэтому активность в обоих инструментах считается вместе.

Если параллельно вести длинный разговор в Claude.ai и запускать Claude Code, доступный объём уменьшается быстрее. В таблице не хватит поля «Claude Code». Добавь источник использования:

| Дата | Поверхность | Авторизация | Лимит | Расход |
|---|---|---|---|---:|
| 2026-08-14 | Claude Code | Pro | Общий | ... |
| 2026-08-14 | Claude.ai | Pro | Общий | ... |
| 2026-08-14 | Claude Code | API key | Console | ... |
| 2026-08-14 | Claude Code | Bedrock | AWS | ... |
| 2026-08-14 | Claude Code | Vertex | Google Cloud | ... |
| 2026-08-14 | Claude Code | Foundry | Microsoft | ... |

Общие лимиты относятся к Pro и Max. Team ведёт лимит по участникам. API key нужно держать отдельно от подписочного объёма: он относится к API-биллингу. Bedrock, Vertex и Foundry тоже контролируются через собственные облачные источники и консоли.

Платные планы используют usage credits для Claude и Claude Code:

Usage credits применяются к разговорам Claude и терминальному использованию Claude Code. Совокупное использование в обоих интерфейсах учитывается вместе.

Поэтому в таблице нужны две пары полей: «тип авторизации» и «источник биллинга».

## Что делать, если лимит сгорает слишком быстро?

Сначала проверь результат, контекст и источник авторизации. В одном зафиксированном случае Claude Code обработал 10 263 334 токена за 6 минут 32 секунды, сделал 15 model calls, 8 Bash calls и 7 чтений файлов, но не изменил ни одной строки. Основная оценочная стоимость пришлась на cache writes.

![Собака в шоке смотрит на карточки с огромным расходом и нулевым результатом.](https://s3.regru.cloud/crossmark/statejnik/images/guides/tokeny-limity-i-schet-tablica-kontrolya-rashodov-claude-code/kadr-3.webp)

Это крайний случай, но он хорошо показывает порядок диагностики. Большой расход без результата нужно считать аварийным событием.

Проверь по порядку:

1. Был ли огромный контекст;
2. Не зациклились ли tool calls;
3. Не запускались ли параллельные процессы;
4. Не загружены ли ненужные MCP;
5. Не повторяется ли старая история;
6. Не использовалась ли дорогая модель без причины;
7. Есть ли изменённые строки;
8. Совпадает ли локальная оценка с источником биллинга.

В том запуске за 6 минут 32 секунды было обработано 10 263 334 токена. Claude Code сделал 15 вызовов модели, 8 Bash-вызовов и 7 чтений файлов. Код не изменился. Автор оценил API-equivalent стоимость примерно в `$109.07`, из которых `$103.79` пришлись на записи кэша.

Цифры относятся к конкретному пользовательскому разбору. Они не описывают гарантированное поведение Claude Code. Но последовательность проверки универсальна:

1. Нажми `Esc`, если цепочка продолжает работать.
2. Сними `/usage` и `/cost`.
3. Проверь `/context`.
4. Посмотри число model calls и tool calls в логах.
5. Проверь cache read и cache write.
6. Запиши, изменился ли код.
7. Отдельно проверь параллельные сессии и автоматизацию.
8. После этого реши, продолжать ли работу.

Если код не меняется, а токены продолжают расти, не жди ещё одного цикла «на всякий случай». Сначала останови процесс.

Переход на Haiku внутри Claude Code тоже не гарантирует освобождение подписочного лимита. Более дешёвая модель может всё равно расходовать общую квоту Anthropic. Внешний API с отдельным бюджетом и дешёвая модель внутри Claude Code - разные способы контроля.

В таблицу аварийного случая добавь:

| Поле | Что записать |
|---|---|
| Время работы | 6 минут 32 секунды |
| Обработано токенов | 10 263 334 |
| Model calls | 15 |
| Bash calls | 8 |
| Чтения файлов | 7 |
| Изменённые строки | 0 |
| API-equivalent | Около `$109.07` |
| Cache writes | Около `$103.79` |
| Следующее действие | Остановить и разобрать логи |

Не переноси эти значения на каждую сессию. Используй их как образец полей для диагностики.

## Вопросы и ответы

Claude Code работает в рамках лимитов выбранного плана или источника авторизации. Для Pro и Max лимиты Claude и Claude Code общие. У Max есть общий недельный лимит и отдельный недельный лимит для Sonnet. Абсолютные значения в токенах зависят от текущей политики Anthropic и не подтверждены в фактуре.

Лимиты Claude и Claude Code shared для Pro и Max. Активность в Claude.ai и Claude Code считается вместе. API key, Bedrock, Vertex и Foundry учитываются отдельно через собственные источники биллинга, поэтому в таблице нужно фиксировать способ авторизации.

В фактуре подтверждены Pro, Max 5x, Max 20x и Team с местами Standard и Premium. Pro служит базовым уровнем сравнения. Max 5x и Max 20x дают относительное увеличение объёма сессии. Team Standard и Premium имеют собственные относительные множители и лимиты по участникам.

Claude Code связывает стоимость с API-токенами. Команды `/usage` и `/cost` показывают локальную оценку по стандартным list rates. Она может отличаться от фактического API-счёта из-за модели, кэширования, скидок, условий договора и способа авторизации. Для сверки API используй Claude Console.

Pro даёт общий лимит для Claude и Claude Code. После достижения включённого объёма можно дождаться сброса или включить usage credits. Anthropic не публикует в собранной фактуре абсолютный лимит Pro в токенах, поэтому точное число нельзя честно назвать.

Max 5x предоставляет в пять раз больше использования за сессию относительно Pro, а Max 20x - в двадцать раз больше. У Max также есть два недельных ограничения: одно для всех моделей и отдельное для Sonnet. Эти значения выражены относительными множителями, фиксированного числа токенов здесь нет.

В расход попадают новый запрос, история сессии, `CLAUDE.md`, прочитанные файлы, результаты инструментов, MCP-контекст и thinking tokens. Каждый новый ход повторно отправляет историю и проектный контекст. Поэтому длина команды не показывает полный объём обработки.

Чем больше контекста Claude Code обрабатывает, тем больше токенов уходит на ход. Контекстное окно составляет 200 000 токенов по умолчанию и 1 000 000 для поддерживаемых моделей с расширенным контекстом. `/context` показывает, какие данные занимают окно.

В этой статье не фиксируется цена подписки Pro, потому что фактура раздела посвящена лимитам, токенам и биллингу, а не актуальной тарифной карточке. Для расхода важнее различать стоимость подписки, общий лимит Pro и дополнительные usage credits.

Цена зависит от модели, размера проекта, длины истории, прочитанных файлов, вызовов инструментов, thinking tokens, параллельных сессий и автоматизации. При API-авторизации локальная оценка `/cost` может отличаться от фактического счёта в Console.

Работу могут остановить контекстное окно, сессионный лимит, недельный лимит, общий лимит подписки, spend limit или остановка usage credits. При достижении контекстной границы Claude Code может сжать историю, но это не отменяет тарифные ограничения.

Pro подходит для меньшего объёма работы, если общий лимит и сброс закрывают задачи. Max даёт относительное увеличение сессионного объёма, но не устраняет расход от большого контекста, параллельных процессов и автоматизации. Перед переходом на Max сначала проверь `/usage`, `/context` и причины роста.

- [Manage costs effectively - Claude Code Docs](https://code.claude.com/docs/en/costs)
- [Models, usage, and limits in Claude Code - Claude Help Center](https://support.claude.com/en/articles/14552983-models-usage-and-limits-in-claude-code)
- [Error reference - Claude Code Docs](https://code.claude.com/docs/en/errors)
- [How Claude Code works](https://code.claude.com/docs/en/how-claude-code-works)
- [Use Claude Code with your Pro or Max plan](https://support.claude.com/en/articles/11145838-use-claude-code-with-your-pro-or-max-plan)
- [What is the Max plan?](https://support.claude.com/en/articles/11049741-what-is-the-max-plan)
- [What is the Team plan?](https://support.claude.com/en/articles/9266767-what-is-the-team-plan)
- [Manage usage credits for paid Claude plans](https://support.claude.com/en/articles/12429409-manage-usage-credits-for-paid-claude-plans)
- [Manage usage credits for Team and seat-based Enterprise plans](https://support.claude.com/en/articles/12005970-manage-usage-credits-for-team-and-seat-based-enterprise-plans)
- [Claude Code burned my entire five-hour limit in 6 minutes 32 seconds](https://www.reddit.com/r/ClaudeCodeTLDR/comments/1vcf2or/tldr_claude-code_burned_entire-fivehour-limit-in-6/)
