Caveman
Plugin Claude Code qui réduit l'usage de tokens de ~65% en forçant des réponses ultra-compactes. Trois niveaux de compression : light, full, ultra. Même précision technique, moins de blabla.
Forces
- Réduction immédiate de ~65% des tokens output sans changer ton workflow
- Trois niveaux ajustables selon le contexte (light pour les revues, ultra pour le code pur)
- Installation en une commande, zéro configuration ensuite
Limites
- Les réponses compressées peuvent perdre en lisibilité pour les débutants
- N'impacte pas les tokens de raisonnement (thinking), gain réel sur session ~4-10%
Pour qui
- Devs qui atteignent régulièrement leurs limites de session Claude Code
- Sessions longues de vibe-coding où les réponses narratives ralentissent le flux