Critères de succès pour un agent IA
Un critère de succès, c'est la définition explicite de ce que « terminé » veut dire pour une tâche donnée, écrite avant de lancer l'agent. La plupart des échecs d'agent ne viennent pas de son incompétence mais d'un objectif resté dans ta tête : tu demandes « range la cuisine » sans dire ce que ranger signifie pour toi, donc l'agent s'arrête sur SA propre idée de fini. Anthropic en fait la première étape de toute application Claude (doc « Define your success criteria ») avec trois exigences : être spécifique, mesurable et atteignable.
Forces
- Levier gratuit et immédiat : trois lignes écrites avant le lancement, aucun changement de stack
- Donne à l'agent une condition d'arrêt nette : il cesse de continuer jusqu'à casser quelque chose
- Te force à clarifier ton propre objectif : si tu ne peux pas le rendre binaire, tu ne savais pas ce que tu voulais
Limites
- Demande un effort en amont que beaucoup zappent : écrire le critère prend plus de discipline qu'un prompt vague
- Un critère binaire mal posé peut sur-contraindre : trop rigide, l'agent rejette des sorties correctes mais non prévues
Pour qui
- Un PM ou PO qui délègue des tâches à un agent et récupère systématiquement du travail « presque fini »
- Un designer ou DS-manager qui veut piloter une IA sans être ingénieur : poser un critère vérifiable est à sa portée
- Un tech lead qui automatise des agents en continu et a besoin de conditions d'arrêt fiables