Почему расход токенов растёт при той же работе
Claude Code на каждом шаге заново читает контекст: содержимое файлов, вывод команд, историю обсуждения. Чем дольше сессия, тем тяжелее этот ком, и значительная его часть повторяется - модель уже это видела, но вы снова платите за то, чтобы протащить это через неё. На длинной задаче по отладке сессия легко разрастается до десятков тысяч токенов, хотя по сути вы не просили ничего лишнего - агент просто тащит за собой весь хвост контекста.
Что делает Headroom
Headroom - небольшая открытая программа, которая встаёт рядом с Claude Code и работает как фильтр на входе в модель. Всё, что агент собирается отправить нейросети, сначала проходит через Headroom: инструмент определяет, что здесь шум, и ужимает его, сохраняя смысл. Оригинал остаётся на вашем компьютере, и если модели понадобится полная версия, она её запросит.
Инструмент открытый (лицензия Apache 2.0) и работает локально - регистрация и отдельный аккаунт не нужны. Отдельный режим Headroom Learn анализирует прошлые сессии, находит повторяющиеся ошибки агента и предлагает поправки прямо в файл CLAUDE.md.
Установка по шагам
Headroom работает поверх уже установленного Claude Code и требует Python версии 3.10 или новее - обычно он уже стоит вместе с агентом.
Установите инструмент одной командой в терминале Claude Code:
pip install "headroom-ai[all]"
Подключите Headroom к Claude Code:
headroom wrap claude
После этого перезапустите Claude Code - сжатие идёт в фоне, менять привычки не нужно. Посмотреть расход токенов до и после сжатия можно командой headroom perf.
Режим Headroom Learn
Headroom Learn анализирует прошлые сессии, находит места, где агент повторял одни и те же ошибки, и записывает поправки в CLAUDE.md. Сначала запустите в режиме просмотра, без изменений:
headroom learn --verbosity
Если предложенные правки устраивают, примените их той же командой с флагом --apply.
Насколько снижается расход
По данным разработчика инструмента, экономия токенов на разных типах задач колеблется в диапазоне примерно от 70 до 95 процентов - эффект сильнее всего заметен на длинных сессиях отладки, где в контексте накапливается много повторяющегося материала. Точная экономия зависит от характера задачи, и эти цифры стоит проверять на своих сессиях командой headroom perf, а не принимать как гарантию.
Чек-лист
- Claude Code установлен и работает
- Версия Python 3.10 или новее
- Headroom установлен и подключён командой wrap
- Claude Code перезапущен после подключения
- Расход токенов проверен командой headroom perf