Headroom: сжимаем данные для ИИ-агентов и экономим до 95% токенов.
Мы нашли на GitHub любопытную тулзу Headroom, которая ужимает логи, файлы, RAG-выдачу и результаты инструментов перед отправкой в модель. По собственным тестам проекта, это позволяет экономить 15–20% токенов у кодинг-агентов и до 60–95% на JSON.
Headroom может работать локально в формате библиотеки, прокси или MCP-сервера и по отдельности обрабатывает код, текст и структурированные данные. При этом оригиналы никуда не исчезают: они хранятся в локальном кэше, а агент при необходимости может запросить обратно нужный фрагмент. Поддержка есть у Codex, Claude Code, Copilot, Cursor и ещё целой пачки агентов — между ними даже доступна общая память.

