ComfyUI
Éditeur node-based open-source pour piloter les modèles de diffusion (SDXL, Flux, SD3, Stable Cascade, Hunyuan/Wan Video, Stable Audio). Tu connectes des nœuds, sampler, scheduler, ControlNet, LoRA, IPAdapter, pour construire un pipeline image, vidéo ou audio reproductible. Standard de facto chez les pros visuels (Netflix, Ubisoft, Nike utilisent les workflows partagés sur Comfy Hub).
Forces
- Contrôle complet : chaque étape du pipeline diffusion est exposée comme nœud inspectable et modifiable
- Catalogue de modèles le plus large (SDXL, Flux, SD3, Hunyuan/Wan Video, Stable Audio, Hunyuan3D), souvent supporté avant les autres UIs
- Comfy Hub : milliers de workflows partagés par la communauté, remixables en 1 clic
- 100% offline une fois installé, GPL-3.0, supporte NVIDIA / AMD / Apple Silicon / Intel Arc
- Smart memory management : tourne sur GPU modestes en streaming les modèles couche par couche
Limites
- Courbe d'apprentissage réelle : il faut comprendre le pipeline diffusion (latent, sampler, scheduler) avant de produire quelque chose
- Setup Python lourd : install des dépendances + plusieurs Go de modèles à télécharger au premier run
- Écosystème custom-nodes fragmenté : qualité variable, ruptures de compat fréquentes entre versions
- UI dense pour démarrer, Automatic1111 ou Forge restent plus accueillants pour du pur text-to-image
Pour qui
- Designers et directeurs artistiques qui doivent reproduire un look précis sur des dizaines d'assets
- Studios VFX / animation / pub qui chaînent ControlNet + LoRA + IPAdapter sur des shots série
- Devs qui veulent exposer un workflow génératif comme API de production (build local, deploy custom)