Гайд

Как контролировать расходы Claude Code

Перевод и практическая адаптация официального руководства Anthropic: как увидеть расход токенов, отличить лимит подписки от API-биллинга и сократить контекст без потери качества работы.

Содержание20 глав
  1. 01Как формируется расход
  2. 02Как посмотреть собственное использование
  3. 03Команда /usage
  4. 04Статистика кэша
  5. 05Разбор лимита подписки
  6. 06Команда /insights
  7. 07Лимиты и дополнительные расходы
  8. 08Как сократить расход токенов
  9. 09Управляй контекстом заранее
  10. 10Подбирай модель под задачу
  11. 11Проверь MCP
  12. 12Фильтруй длинный вывод хуками
  13. 13Перенеси узкие инструкции из CLAUDE.md в skills
  14. 14Используй субагентов для объемного вывода
  15. 15Ограничивай агентные команды
  16. 16Формулируй точные запросы
  17. 17Работай по контрольным точкам
  18. 18Почему расход растет в длинной сессии
  19. 19Рекомендации для команд
  20. 20Короткий порядок действий

Как формируется расход

При API-доступе Claude Code тарифицируется по токенам. В подписках Pro, Max, Team и Enterprise работа входит в тариф и ограничивается окнами использования. На итоговый расход влияют выбранная модель, размер проекта, длина сессии, количество параллельных процессов и автоматизация.

Anthropic приводит ориентиры для корпоративных внедрений: около 13 долларов на разработчика за активный день и 150–250 долларов в месяц; у 90% пользователей расход остается ниже 30 долларов за активный день. Это ориентир для планирования, а не обещанная цена конкретной учетной записи.

Как посмотреть собственное использование

Команда /usage

Верхний блок показывает статистику текущей сессии: токены по моделям, продолжительность, объем изменений и расчетную стоимость. Для подписчиков Pro и Max эта сумма не является счетом: использование уже включено в план. При API-доступе точные начисления нужно проверять в Claude Console.

После /clear счетчики новой сессии начинаются с нуля. Для сравнения задач удобно сначала переименовать нужную сессию через /rename, затем очистить историю и открыть отдельную задачу.

Статистика кэша

В актуальных версиях Claude Code строка Prompt cache (main) показывает число запросов, долю входных токенов, полученных из кэша, промахи и состояние кэша.

  • Misses — повторная обработка данных, которые могли быть прочитаны из кэша.
  • Expected rebuilds — ожидаемая пересборка после сжатия истории или очистки старых результатов инструментов.
  • Warm / cold — находится ли сохраненный префикс в пределах срока жизни кэша.

Эта статистика относится к основному диалогу и не включает субагентов. Она обнуляется вместе с сессией.

Разбор лимита подписки

На Pro, Max, Team и Enterprise команда /usage может показывать:

  • долю skills, субагентов, плагинов и отдельных MCP-серверов;
  • поведенческие сигналы, например длинный контекст или частые промахи кэша;
  • самые тяжелые задачи /loop и другие запуски по расписанию;
  • период за последние 24 часа или 7 дней.

Расчет строится по локальной истории на текущем устройстве. Работа на других компьютерах и в claude.ai сюда не попадает.

Команда /insights

/insights анализирует стиль работы, а не только количество токенов. В отчет входят типовые задачи, затруднения, ошибочно понятые запросы, проблемный код и рекомендации по процессу.

За один запуск обрабатывается до 200 ранее не разобранных сессий. Последний отчет сохраняется в ~/.claude/usage-data/report.html, рядом остаются версии с временной меткой. Анализ использует текущего провайдера и сам расходует токены.

Лимиты и дополнительные расходы

СообщениеЧто произошлоЧто делать
Достигнут лимит сессии или неделиЗакончилось окно подписки, общее для моделей.Дождаться сброса или подключить usage credits, если они доступны.
Достигнут лимит Opus или SonnetИсчерпано окно конкретного семейства моделей.Переключиться через /model на другое семейство.
Достигнут индивидуальный или командный бюджетИсчерпан установленный лимит дополнительных кредитов.Администратор меняет лимит в настройках организации.
Предупреждение о контексте или auto-compactДиалог приблизился к порогу сжатия.Сократить контекст, выполнить /compact или начать новую сессию.

Как сократить расход токенов

Управляй контекстом заранее

  • Начинай новую сессию для несвязанной задачи через /clear.
  • Возвращайся к нужной работе через /resume, а перед очисткой используй /rename.
  • При сжатии указывай приоритет: /compact Сохрани изменения кода, результаты тестов и нерешенные ошибки.
  • Добавь в CLAUDE.md короткие инструкции о том, что сохранять при сжатии.

Подбирай модель под задачу

Sonnet подходит для большинства задач разработки. Opus стоит оставлять для архитектуры и сложного многошагового анализа. Простые субагенты могут работать на Haiku. Модель меняется через /model, а уровень рассуждения — через /effort или настройки модели.

Проверь MCP

Claude Code откладывает загрузку полных описаний MCP-инструментов до момента использования, однако имена серверов и инструкции все равно входят в контекст. Запусти /context, затем /mcp и отключи серверы, которые не нужны в текущем проекте.

Если задачу можно выполнить обычной командой, CLI часто экономнее. Например, gh, aws, gcloud и sentry-cli не добавляют постоянный список MCP-инструментов.

Фильтруй длинный вывод хуками

Тесты, сборки и логи могут вернуть тысячи строк. PreToolUse-хук способен изменить команду так, чтобы Claude получил только ошибки и краткую сводку, а полный вывод сохранился отдельно.

{
  "hooks": {
    "PreToolUse": [
      {
        "matcher": "Bash",
        "hooks": [
          {
            "type": "command",
            "command": "~/.claude/hooks/filter-test-output.sh"
          }
        ]
      }
    ]
  }
}

После установки проверь конфигурацию через /hooks и тестовую команду. Хук должен сохранять код завершения и не менять команды, для которых фильтрация не предусмотрена.

Перенеси узкие инструкции из CLAUDE.md в skills

CLAUDE.md загружается при старте сессии. Если там лежат подробные правила ревью, миграций или публикации, они участвуют даже в несвязанных задачах. Skills подключаются по необходимости. В документации рекомендуется держать базовый CLAUDE.md короче 200 строк и оставлять в нем только постоянные правила.

Используй субагентов для объемного вывода

Субагент полезен, когда тесты, документация или логи не должны попадать в основной диалог. Он работает в отдельном контексте и возвращает сводку. При этом каждый субагент имеет собственное окно контекста, поэтому маленькая задача, большое число агентов или неверно выбранная модель способны увеличить расход.

Ограничивай агентные команды

Каждый участник агентной команды — отдельный экземпляр Claude Code. Расход растет примерно вместе с числом активных участников и продолжительностью их работы. Держи команду небольшой, задавай узкие задачи, используй Sonnet для координации и завершай агентов после результата.

Формулируй точные запросы

Запрос «улучши проект» запускает широкий поиск. Запрос «добавь проверку email в функцию регистрации и покрой три заданных сценария тестами» ограничивает область чтения и снижает количество повторных проходов.

Работай по контрольным точкам

  • Для сложной задачи сначала используй режим планирования.
  • Останавливай неверное направление клавишей Escape.
  • Возвращайся к контрольной точке через /rewind.
  • Заранее задавай тесты, скриншоты или ожидаемый результат.
  • Проверяй изменения небольшими порциями.

Почему расход растет в длинной сессии

  • Длинная история. Каждый новый запрос несет контекст беседы и результаты инструментов.
  • Промах кэша. После длительного простоя весь контекст может обрабатываться заново.
  • Задачи по расписанию. Каждый запуск отправляет контекст, даже если пользователь не пишет.
  • Межсессионные сообщения. Новое входящее сообщение создает еще один ход с текущей историей.
  • Проверки целей. Активная цель может запускать фоновые проверки.
  • Активные участники агентной команды. Каждый продолжает расходовать токены до завершения.
  • Сжатие. /compact сначала читает историю, которую должен суммировать. Если продолжение не нужно, /clear дешевле.

Рекомендации для команд

Размер командыTPM на пользователяRPM на пользователя
1–5200–300 тыс.5–7
5–20100–150 тыс.2,5–3,5
20–5050–75 тыс.1,25–1,75
50–10025–35 тыс.0,62–0,87
100–50015–20 тыс.0,37–0,47
500+10–15 тыс.0,25–0,35

Это ориентиры Anthropic для расчета общих лимитов организации. Они применяются на уровне организации, поэтому отдельный активный пользователь может временно использовать больше своей расчетной доли.

Короткий порядок действий

  1. Запусти /usage и /context.
  2. Найди длинные сессии, промахи кэша, тяжелые модели, субагентов, MCP и циклы.
  3. Раздели несвязанные задачи и сократи базовый контекст.
  4. Перенеси объемный вывод в хуки или отдельные субагенты.
  5. Останови фоновые процессы, которые больше не нужны.
  6. Через несколько рабочих сессий повтори измерение.

Claude Code регулярно обновляется. Перед настройкой проверь версию командой claude --version. Для вопросов по конкретному счету или лимиту используй поддержку Anthropic внутри claude.ai или Claude Console.