RAG (pour débutants)
RAG = Retrieval-Augmented Generation. Avant de répondre, le LLM « lit » des documents pertinents dans votre base. Résultat : il répond à partir de VOS données, pas de sa mémoire d'entraînement.
Forces
- Pas de fine-tuning, mise à jour des données instantanée, pas de réentraînement
Limites
- La qualité dépend du chunking et du modèle d'embedding
Pour qui
- Tout projet qui doit répondre à partir d'une base de connaissance privée