# Как контролировать расходы Claude Code

Перевод и практическая адаптация официального руководства Anthropic: как увидеть расход токенов, отличить лимит подписки от API-биллинга и сократить контекст без потери качества работы.

- **Первоисточник:** [Manage costs effectively — Claude Code Docs](https://code.claude.com/docs/en/costs).

## Как формируется расход

При API-доступе Claude Code тарифицируется по токенам. В подписках Pro, Max, Team и Enterprise работа входит в тариф и ограничивается окнами использования. На итоговый расход влияют выбранная модель, размер проекта, длина сессии, количество параллельных процессов и автоматизация.

Anthropic приводит ориентиры для корпоративных внедрений: около 13 долларов на разработчика за активный день и 150–250 долларов в месяц; у 90% пользователей расход остается ниже 30 долларов за активный день. Это ориентир для планирования, а не обещанная цена конкретной учетной записи.

## Как посмотреть собственное использование

## Команда `/usage`

Верхний блок показывает статистику текущей сессии: токены по моделям, продолжительность, объем изменений и расчетную стоимость. Для подписчиков Pro и Max эта сумма не является счетом: использование уже включено в план. При API-доступе точные начисления нужно проверять в Claude Console.

После `/clear` счетчики новой сессии начинаются с нуля. Для сравнения задач удобно сначала переименовать нужную сессию через `/rename`, затем очистить историю и открыть отдельную задачу.

## Статистика кэша

В актуальных версиях Claude Code строка `Prompt cache (main)` показывает число запросов, долю входных токенов, полученных из кэша, промахи и состояние кэша.

- **Misses** — повторная обработка данных, которые могли быть прочитаны из кэша.
- **Expected rebuilds** — ожидаемая пересборка после сжатия истории или очистки старых результатов инструментов.
- **Warm / cold** — находится ли сохраненный префикс в пределах срока жизни кэша.

Эта статистика относится к основному диалогу и не включает субагентов. Она обнуляется вместе с сессией.

## Разбор лимита подписки

На Pro, Max, Team и Enterprise команда `/usage` может показывать:

- долю skills, субагентов, плагинов и отдельных MCP-серверов;
- поведенческие сигналы, например длинный контекст или частые промахи кэша;
- самые тяжелые задачи `/loop` и другие запуски по расписанию;
- период за последние 24 часа или 7 дней.

Расчет строится по локальной истории на текущем устройстве. Работа на других компьютерах и в claude.ai сюда не попадает.

## Команда `/insights`

`/insights` анализирует стиль работы, а не только количество токенов. В отчет входят типовые задачи, затруднения, ошибочно понятые запросы, проблемный код и рекомендации по процессу.

За один запуск обрабатывается до 200 ранее не разобранных сессий. Последний отчет сохраняется в `~/.claude/usage-data/report.html`, рядом остаются версии с временной меткой. Анализ использует текущего провайдера и сам расходует токены.

## Лимиты и дополнительные расходы

| Сообщение | Что произошло | Что делать |
| --- | --- | --- |
| Достигнут лимит сессии или недели | Закончилось окно подписки, общее для моделей. | Дождаться сброса или подключить usage credits, если они доступны. |
| Достигнут лимит Opus или Sonnet | Исчерпано окно конкретного семейства моделей. | Переключиться через `/model` на другое семейство. |
| Достигнут индивидуальный или командный бюджет | Исчерпан установленный лимит дополнительных кредитов. | Администратор меняет лимит в настройках организации. |
| Предупреждение о контексте или auto-compact | Диалог приблизился к порогу сжатия. | Сократить контекст, выполнить `/compact` или начать новую сессию. |

## Как сократить расход токенов

## Управляй контекстом заранее

- Начинай новую сессию для несвязанной задачи через `/clear`.
- Возвращайся к нужной работе через `/resume`, а перед очисткой используй `/rename`.
- При сжатии указывай приоритет: `/compact Сохрани изменения кода, результаты тестов и нерешенные ошибки`.
- Добавь в `CLAUDE.md` короткие инструкции о том, что сохранять при сжатии.

## Подбирай модель под задачу

Sonnet подходит для большинства задач разработки. Opus стоит оставлять для архитектуры и сложного многошагового анализа. Простые субагенты могут работать на Haiku. Модель меняется через `/model`, а уровень рассуждения — через `/effort` или настройки модели.

## Проверь MCP

Claude Code откладывает загрузку полных описаний MCP-инструментов до момента использования, однако имена серверов и инструкции все равно входят в контекст. Запусти `/context`, затем `/mcp` и отключи серверы, которые не нужны в текущем проекте.

Если задачу можно выполнить обычной командой, CLI часто экономнее. Например, `gh`, `aws`, `gcloud` и `sentry-cli` не добавляют постоянный список MCP-инструментов.

## Фильтруй длинный вывод хуками

Тесты, сборки и логи могут вернуть тысячи строк. PreToolUse-хук способен изменить команду так, чтобы Claude получил только ошибки и краткую сводку, а полный вывод сохранился отдельно.

```
{
  "hooks": {
    "PreToolUse": [
      {
        "matcher": "Bash",
        "hooks": [
          {
            "type": "command",
            "command": "~/.claude/hooks/filter-test-output.sh"
          }
        ]
      }
    ]
  }
}
```

После установки проверь конфигурацию через `/hooks` и тестовую команду. Хук должен сохранять код завершения и не менять команды, для которых фильтрация не предусмотрена.

## Перенеси узкие инструкции из CLAUDE.md в skills

`CLAUDE.md` загружается при старте сессии. Если там лежат подробные правила ревью, миграций или публикации, они участвуют даже в несвязанных задачах. Skills подключаются по необходимости. В документации рекомендуется держать базовый `CLAUDE.md` короче 200 строк и оставлять в нем только постоянные правила.

## Используй субагентов для объемного вывода

Субагент полезен, когда тесты, документация или логи не должны попадать в основной диалог. Он работает в отдельном контексте и возвращает сводку. При этом каждый субагент имеет собственное окно контекста, поэтому маленькая задача, большое число агентов или неверно выбранная модель способны увеличить расход.

## Ограничивай агентные команды

Каждый участник агентной команды — отдельный экземпляр Claude Code. Расход растет примерно вместе с числом активных участников и продолжительностью их работы. Держи команду небольшой, задавай узкие задачи, используй Sonnet для координации и завершай агентов после результата.

## Формулируй точные запросы

Запрос «улучши проект» запускает широкий поиск. Запрос «добавь проверку email в функцию регистрации и покрой три заданных сценария тестами» ограничивает область чтения и снижает количество повторных проходов.

## Работай по контрольным точкам

- Для сложной задачи сначала используй режим планирования.
- Останавливай неверное направление клавишей Escape.
- Возвращайся к контрольной точке через `/rewind`.
- Заранее задавай тесты, скриншоты или ожидаемый результат.
- Проверяй изменения небольшими порциями.

## Почему расход растет в длинной сессии

- **Длинная история.** Каждый новый запрос несет контекст беседы и результаты инструментов.
- **Промах кэша.** После длительного простоя весь контекст может обрабатываться заново.
- **Задачи по расписанию.** Каждый запуск отправляет контекст, даже если пользователь не пишет.
- **Межсессионные сообщения.** Новое входящее сообщение создает еще один ход с текущей историей.
- **Проверки целей.** Активная цель может запускать фоновые проверки.
- **Активные участники агентной команды.** Каждый продолжает расходовать токены до завершения.
- **Сжатие.** `/compact` сначала читает историю, которую должен суммировать. Если продолжение не нужно, `/clear` дешевле.

## Рекомендации для команд

| Размер команды | TPM на пользователя | RPM на пользователя |
| --- | --- | --- |
| 1–5 | 200–300 тыс. | 5–7 |
| 5–20 | 100–150 тыс. | 2,5–3,5 |
| 20–50 | 50–75 тыс. | 1,25–1,75 |
| 50–100 | 25–35 тыс. | 0,62–0,87 |
| 100–500 | 15–20 тыс. | 0,37–0,47 |
| 500+ | 10–15 тыс. | 0,25–0,35 |

Это ориентиры Anthropic для расчета общих лимитов организации. Они применяются на уровне организации, поэтому отдельный активный пользователь может временно использовать больше своей расчетной доли.

## Короткий порядок действий

1. Запусти `/usage` и `/context`.
2. Найди длинные сессии, промахи кэша, тяжелые модели, субагентов, MCP и циклы.
3. Раздели несвязанные задачи и сократи базовый контекст.
4. Перенеси объемный вывод в хуки или отдельные субагенты.
5. Останови фоновые процессы, которые больше не нужны.
6. Через несколько рабочих сессий повтори измерение.

> Claude Code регулярно обновляется. Перед настройкой проверь версию командой `claude --version`. Для вопросов по конкретному счету или лимиту используй поддержку Anthropic внутри claude.ai или Claude Console.

---

Источник: https://localhost:3000/m/kak-kontrolirovat-rashody-claude-code
