Headroom
Couche de compression de contexte qui se place entre ton agent et le modèle. Elle intercepte ce que l'agent lit avant l'envoi, sorties d'outils, logs, fichiers, fragments de recherche et historique de conversation, et la compresse de façon réversible : l'original reste récupérable à la demande. Le moteur est écrit en Rust, piloté en Python ou en TypeScript, et s'utilise en bibliothèque, en proxy compatible OpenAI, ou en serveur MCP. Licence Apache 2.0. Pour Claude Code, l'installation passe par `headroom wrap claude`, qui pose un proxy transparent sans toucher au projet.
Forces
- Compression réversible : le texte original reste récupérable, tu ne perds pas la donnée en route
- Quatre modes de branchement (bibliothèque, proxy, wrapper d'agent, serveur MCP) sans réécrire ton code
- Compression consciente de la syntaxe pour Python, JS, TS, Go, Rust, Java et C, pas une troncature aveugle
Limites
- Le chiffre spectaculaire porte sur le JSON : sur un agent de code, le dépôt annonce 15 à 20%
- Un proxy local de plus dans la chaîne, donc une cause supplémentaire quand une réponse part de travers
- Python 3.10 ou plus requis, et inutilisable dans un environnement isolé où aucun processus local ne tourne
Pour qui
- Un agent qui avale des sorties d'outils massives, recherche dans le code ou session de debug, et sature son contexte
- Une chaîne qui fait transiter du JSON volumineux entre outils et modèle à chaque tour