MiniMax Speech
Le modèle de synthèse vocale de MiniMax (version 2.8, sortie le 23 janvier 2026), utilisable depuis le studio web minimax.io ou par API. Tu tapes un texte, il rend une voix off ; tu lui donnes entre 10 secondes et 5 minutes de ta voix, il la clone. Deux niveaux : HD pour la qualité, Turbo pour le coût. Une quarantaine de langues, et des balises d'interjection (rire, soupir, respiration) pour casser le ton récité.
Forces
- Tarif à l'usage publié et lisible, avec un niveau Turbo moins cher pour le volume
- Clonage à partir de 10 secondes d'audio, directement depuis le studio web
- Balises d'interjection (rire, soupir, respiration) qui cassent le ton récité d'une voix off
Limites
- Aucune vérification de consentement documentée pour le clonage
- Tout passe par le cloud : ta voix et tes textes quittent ta machine
- Rendu à juger sur ton propre script : la promesse de sa diffusion ne vaut pas mesure
Pour qui
- Créateurs de contenu qui produisent des voix off régulières et veulent réduire le coût
- Équipes produit qui prototypent une narration ou un agent vocal avant de choisir un fournisseur