Paramètres de génération LLM

Les paramètres de génération, ce sont les réglages qui pilotent CE que le modèle sort une fois le prompt fixé, pas ce que tu lui demandes mais la façon dont il le produit. Il y en a cinq qui reviennent partout. « max-tokens » : le plafond de longueur de la réponse, il joue directement sur le coût et la latence. « temperature » : à quel point le modèle suit les probabilités les plus fortes, bas donne du prévisible et répétable, haut donne du varié et créatif. « top-p » (nucleus) : au lieu de régler l'audace, il coupe la traîne des tokens improbables et ne garde que le noyau vraisemblable. « pénalité de répétition » : réduit les mots et tournures qui reviennent en boucle. « stop-sequence » : arrête net la génération dès qu'un mot ou un symbole choisi apparaît.

Forces

Limites

Pour qui

Site officiel

Voir sur Coeurdar