
Как контролировать расходы Claude Code
Перевод и практическая адаптация официального руководства Anthropic: как увидеть расход токенов, отличить лимит подписки от API-биллинга и сократить контекст без потери качества работы.
Содержание20 глав
- 01Как формируется расход
- 02Как посмотреть собственное использование
- 03Команда /usage
- 04Статистика кэша
- 05Разбор лимита подписки
- 06Команда /insights
- 07Лимиты и дополнительные расходы
- 08Как сократить расход токенов
- 09Управляй контекстом заранее
- 10Подбирай модель под задачу
- 11Проверь MCP
- 12Фильтруй длинный вывод хуками
- 13Перенеси узкие инструкции из CLAUDE.md в skills
- 14Используй субагентов для объемного вывода
- 15Ограничивай агентные команды
- 16Формулируй точные запросы
- 17Работай по контрольным точкам
- 18Почему расход растет в длинной сессии
- 19Рекомендации для команд
- 20Короткий порядок действий
- Первоисточник: Manage costs effectively — Claude Code Docs.
Как формируется расход
При API-доступе Claude Code тарифицируется по токенам. В подписках Pro, Max, Team и Enterprise работа входит в тариф и ограничивается окнами использования. На итоговый расход влияют выбранная модель, размер проекта, длина сессии, количество параллельных процессов и автоматизация.
Anthropic приводит ориентиры для корпоративных внедрений: около 13 долларов на разработчика за активный день и 150–250 долларов в месяц; у 90% пользователей расход остается ниже 30 долларов за активный день. Это ориентир для планирования, а не обещанная цена конкретной учетной записи.
Как посмотреть собственное использование
Команда /usage
Верхний блок показывает статистику текущей сессии: токены по моделям, продолжительность, объем изменений и расчетную стоимость. Для подписчиков Pro и Max эта сумма не является счетом: использование уже включено в план. При API-доступе точные начисления нужно проверять в Claude Console.
После /clear счетчики новой сессии начинаются с нуля. Для сравнения задач удобно сначала переименовать нужную сессию через /rename, затем очистить историю и открыть отдельную задачу.
Статистика кэша
В актуальных версиях Claude Code строка Prompt cache (main) показывает число запросов, долю входных токенов, полученных из кэша, промахи и состояние кэша.
- Misses — повторная обработка данных, которые могли быть прочитаны из кэша.
- Expected rebuilds — ожидаемая пересборка после сжатия истории или очистки старых результатов инструментов.
- Warm / cold — находится ли сохраненный префикс в пределах срока жизни кэша.
Эта статистика относится к основному диалогу и не включает субагентов. Она обнуляется вместе с сессией.
Разбор лимита подписки
На Pro, Max, Team и Enterprise команда /usage может показывать:
- долю skills, субагентов, плагинов и отдельных MCP-серверов;
- поведенческие сигналы, например длинный контекст или частые промахи кэша;
- самые тяжелые задачи
/loopи другие запуски по расписанию; - период за последние 24 часа или 7 дней.
Расчет строится по локальной истории на текущем устройстве. Работа на других компьютерах и в claude.ai сюда не попадает.
Команда /insights
/insights анализирует стиль работы, а не только количество токенов. В отчет входят типовые задачи, затруднения, ошибочно понятые запросы, проблемный код и рекомендации по процессу.
За один запуск обрабатывается до 200 ранее не разобранных сессий. Последний отчет сохраняется в ~/.claude/usage-data/report.html, рядом остаются версии с временной меткой. Анализ использует текущего провайдера и сам расходует токены.
Лимиты и дополнительные расходы
| Сообщение | Что произошло | Что делать |
|---|---|---|
| Достигнут лимит сессии или недели | Закончилось окно подписки, общее для моделей. | Дождаться сброса или подключить usage credits, если они доступны. |
| Достигнут лимит Opus или Sonnet | Исчерпано окно конкретного семейства моделей. | Переключиться через /model на другое семейство. |
| Достигнут индивидуальный или командный бюджет | Исчерпан установленный лимит дополнительных кредитов. | Администратор меняет лимит в настройках организации. |
| Предупреждение о контексте или auto-compact | Диалог приблизился к порогу сжатия. | Сократить контекст, выполнить /compact или начать новую сессию. |
Как сократить расход токенов
Управляй контекстом заранее
- Начинай новую сессию для несвязанной задачи через
/clear. - Возвращайся к нужной работе через
/resume, а перед очисткой используй/rename. - При сжатии указывай приоритет:
/compact Сохрани изменения кода, результаты тестов и нерешенные ошибки. - Добавь в
CLAUDE.mdкороткие инструкции о том, что сохранять при сжатии.
Подбирай модель под задачу
Sonnet подходит для большинства задач разработки. Opus стоит оставлять для архитектуры и сложного многошагового анализа. Простые субагенты могут работать на Haiku. Модель меняется через /model, а уровень рассуждения — через /effort или настройки модели.
Проверь MCP
Claude Code откладывает загрузку полных описаний MCP-инструментов до момента использования, однако имена серверов и инструкции все равно входят в контекст. Запусти /context, затем /mcp и отключи серверы, которые не нужны в текущем проекте.
Если задачу можно выполнить обычной командой, CLI часто экономнее. Например, gh, aws, gcloud и sentry-cli не добавляют постоянный список MCP-инструментов.
Фильтруй длинный вывод хуками
Тесты, сборки и логи могут вернуть тысячи строк. PreToolUse-хук способен изменить команду так, чтобы Claude получил только ошибки и краткую сводку, а полный вывод сохранился отдельно.
{
"hooks": {
"PreToolUse": [
{
"matcher": "Bash",
"hooks": [
{
"type": "command",
"command": "~/.claude/hooks/filter-test-output.sh"
}
]
}
]
}
}
После установки проверь конфигурацию через /hooks и тестовую команду. Хук должен сохранять код завершения и не менять команды, для которых фильтрация не предусмотрена.
Перенеси узкие инструкции из CLAUDE.md в skills
CLAUDE.md загружается при старте сессии. Если там лежат подробные правила ревью, миграций или публикации, они участвуют даже в несвязанных задачах. Skills подключаются по необходимости. В документации рекомендуется держать базовый CLAUDE.md короче 200 строк и оставлять в нем только постоянные правила.
Используй субагентов для объемного вывода
Субагент полезен, когда тесты, документация или логи не должны попадать в основной диалог. Он работает в отдельном контексте и возвращает сводку. При этом каждый субагент имеет собственное окно контекста, поэтому маленькая задача, большое число агентов или неверно выбранная модель способны увеличить расход.
Ограничивай агентные команды
Каждый участник агентной команды — отдельный экземпляр Claude Code. Расход растет примерно вместе с числом активных участников и продолжительностью их работы. Держи команду небольшой, задавай узкие задачи, используй Sonnet для координации и завершай агентов после результата.
Формулируй точные запросы
Запрос «улучши проект» запускает широкий поиск. Запрос «добавь проверку email в функцию регистрации и покрой три заданных сценария тестами» ограничивает область чтения и снижает количество повторных проходов.
Работай по контрольным точкам
- Для сложной задачи сначала используй режим планирования.
- Останавливай неверное направление клавишей Escape.
- Возвращайся к контрольной точке через
/rewind. - Заранее задавай тесты, скриншоты или ожидаемый результат.
- Проверяй изменения небольшими порциями.
Почему расход растет в длинной сессии
- Длинная история. Каждый новый запрос несет контекст беседы и результаты инструментов.
- Промах кэша. После длительного простоя весь контекст может обрабатываться заново.
- Задачи по расписанию. Каждый запуск отправляет контекст, даже если пользователь не пишет.
- Межсессионные сообщения. Новое входящее сообщение создает еще один ход с текущей историей.
- Проверки целей. Активная цель может запускать фоновые проверки.
- Активные участники агентной команды. Каждый продолжает расходовать токены до завершения.
- Сжатие.
/compactсначала читает историю, которую должен суммировать. Если продолжение не нужно,/clearдешевле.
Рекомендации для команд
| Размер команды | TPM на пользователя | RPM на пользователя |
|---|---|---|
| 1–5 | 200–300 тыс. | 5–7 |
| 5–20 | 100–150 тыс. | 2,5–3,5 |
| 20–50 | 50–75 тыс. | 1,25–1,75 |
| 50–100 | 25–35 тыс. | 0,62–0,87 |
| 100–500 | 15–20 тыс. | 0,37–0,47 |
| 500+ | 10–15 тыс. | 0,25–0,35 |
Это ориентиры Anthropic для расчета общих лимитов организации. Они применяются на уровне организации, поэтому отдельный активный пользователь может временно использовать больше своей расчетной доли.
Короткий порядок действий
- Запусти
/usageи/context. - Найди длинные сессии, промахи кэша, тяжелые модели, субагентов, MCP и циклы.
- Раздели несвязанные задачи и сократи базовый контекст.
- Перенеси объемный вывод в хуки или отдельные субагенты.
- Останови фоновые процессы, которые больше не нужны.
- Через несколько рабочих сессий повтори измерение.
Claude Code регулярно обновляется. Перед настройкой проверь версию командой
claude --version. Для вопросов по конкретному счету или лимиту используй поддержку Anthropic внутри claude.ai или Claude Console.
Связанные материалы


