LeanCTX
Binaire Rust local qui s'intercale entre ton agent et le modèle. Il compresse ce que l'agent lit et le shell output (60 à 90 % de tokens en moins), met en cache les relectures à environ 13 tokens et garde une trace signée de ce qui est sauvegardé.
Forces
- 60 à 90 % de tokens en moins sur les lectures et le shell output
- Local-first : binaire Rust chez toi, rien ne transite par un service tiers
- Cache des relectures à environ 13 tokens, l'agent ne repaye pas un fichier déjà vu
Limites
- Couche supplémentaire à brancher, un point de friction de plus dans le pipeline
- Récent, le gain réel dépend fortement de la part de reads dans ta session
Pour qui
- Sessions agentiques longues où les reads répétés dominent le budget tokens
- Contextes sensibles où le code ne doit pas transiter par un service externe