Ollama
LLM en local, zero cloud. Idéal pour les workflows offline et la confidentialité.
Forces
- Données ne quittent jamais votre machine, confidentialité totale, zéro risque
- 100% gratuit, licence MIT, pas de coûts API quel que soit le volume
- Simplicité "Docker pour les LLMs", installation et lancement en une commande
- 100+ modèles open source incluant Llama, Mistral, Qwen, Phi et Gemma
Limites
- Plus lent que les APIs cloud, 10 à 30s de sortie pour les grands modèles sans GPU
- Pas d'interface graphique native, doit être associé à une UI web ou extension
- Les modèles 70B+ nécessitent une VRAM GPU importante ou quantification agressive
Pour qui
- Équipes axées sur la confidentialité exécutant des LLMs sur données sensibles
- Inférence locale à fort volume où les coûts d'API seraient prohibitifs