RAG
Retrieval-Augmented Generation
Traduction
IA qui lit vos documents avant de répondre
En clair
Une technique pour qu’une IA réponde à partir de VOS documents plutôt que de sa mémoire générale. C’est ce qui se cache derrière la plupart des « chatbots entraînés sur vos données », qui ne sont d’ailleurs pas entraînés du tout.
Version technique
Architecture couplant un modèle de langage à une base documentaire : la question est convertie en vecteur (embedding), les passages les plus proches sont récupérés dans une base vectorielle, puis injectés dans le prompt pour ancrer la réponse. Réduit les hallucinations et permet de citer ses sources, sans réentraîner le modèle, à la différence du fine-tuning. La qualité dépend surtout du découpage des documents et de la pertinence de la recherche.
Entendu en réunion
« Notre assistant est un RAG sur votre base documentaire avec du reranking sémantique. »