Programmatic Tool Calling
Au lieu de charger toutes les définitions d'outils dans le contexte et de laisser le modèle les appeler un par un, tu lui donnes un environnement d'exécution de code où il écrit lui-même le script qui appelle ces outils. Les résultats intermédiaires restent dans le container : le modèle ne voit que ce que tu choisis de lui renvoyer. C'est la réponse d'Anthropic au gonflement de contexte des agents bardés d'outils, lancée en GA en novembre 2025.
Forces
- Isole les réponses des outils : tu décides ce qui revient en contexte au lieu de tout injecter d'office
- Environ 38% de tokens facturés en moins sur un benchmark à 75 outils, sans perte de précision (mesure Anthropic)
- Permet de chaîner plusieurs appels (et plusieurs serveurs MCP) dans un seul script, en un aller-retour
- Recommandé par la recherche Anthropic : les agents s'en sortent mieux en écrivant du code qu'en enchaînant des appels d'outils bruts
Limites
- Nécessite un environnement d'exécution de code sécurisé (sandbox), pas juste un appel API classique
- Sur-dimensionné pour 2 ou 3 outils déterministes : un appel direct reste plus simple
- Débugger un script qui orchestre plusieurs outils demande plus de discipline que tracer un appel isolé
Pour qui
- Agents production avec 10 outils ou plus, ou plusieurs serveurs MCP branchés : c'est là que les économies de tokens deviennent visibles sur la facture
- Workflows où un outil bavard renvoie de gros payloads dont l'agent n'a besoin que d'un extrait
- Tâches multi-étapes où l'agent doit enchaîner plusieurs outils sans repasser par le modèle à chaque étape