IA
RAG
Retrieval-Augmented Generation
Le RAG est l’architecture standard des moteurs IA : avant de répondre, le système récupère des documents pertinents, puis génère une réponse ancrée sur ces sources plutôt que sur la seule mémoire du modèle.
Le principe tient en deux temps :
- récupération : on retrouve les passages utiles, souvent via une base vectorielle ;
- génération : le modèle rédige sa réponse en s’appuyant sur ces passages.
C’est ce qui rend le grounding possible, et donc ce qui décide quels contenus une IA peut citer.