Sakana Fugu (Fugu / Fugu Ultra)
Modèle du labo japonais Sakana AI, lancé commercialement en juin 2026, qui n'est pas vraiment un modèle : c'est un système multi-agent déguisé en un seul, exposé via une API compatible OpenAI. Tu envoies ta requête à un endpoint unique ; derrière, Fugu décide seul s'il répond lui-même ou s'il assemble une équipe de modèles frontière spécialisés, les coordonne, vérifie et synthétise le résultat. Deux variantes : Fugu (équilibré, faible latence) et Fugu Ultra (qualité maximale sur les problèmes durs, il mobilise un pool d'agents plus profond). Fondé sur deux papiers ICLR 2026 (TRINITY et Conductor) sur l'orchestration apprise.
Forces
- Anti-lock-in : route autour d'un fournisseur qui tombe ou durcit ses conditions
- API compatible OpenAI : branchement par simple swap d'URL, pas de réécriture
- Routage automatique vers le modèle spécialisé le plus adapté à la tâche
Limites
- Latence plus haute : coordonner plusieurs modèles coûte du temps face à un appel direct
- Opacité : tu ne choisis pas quel sous-modèle traite ta requête ni voit ta donnée
- Coût et pertinence à valider : pour beaucoup de cas, un modèle frontière direct suffit
Pour qui
- Une équipe dont la contrainte n'est pas le score mais la continuité de service multi-fournisseur
- Un tech lead qui veut une couche d'abstraction anti-dépendance sans réécrire ses appels