FR
Glossaire de l'IA

Qu'est-ce que le RAG (Retrieval-Augmented Generation) ?

Durée3 lecture min.Mis à jour 3 juillet 2026

En bref

Le RAG, abréviation de Retrieval-Augmented Generation, est une technique qui donne à un modèle d'IA, au moment de votre question, des informations pertinentes à lire, pour que sa réponse soit ancrée dans des documents réels et à jour plutôt que seulement dans ce qu'il a mémorisé à l'entraînement. Au lieu d'espérer que le modèle connaisse déjà vos données, un système RAG récupère d'abord les extraits les plus pertinents d'une source de connaissances (vos docs, une base de données, un jeu de PDF), les insère comme contexte dans le prompt, puis demande au modèle de répondre avec ce matériel. Le résultat : des réponses qui citent vos vrais contenus, restent à jour à mesure que vos données changent et hallucinent moins, sans le coût d'un réentraînement du modèle.

Comment fonctionne le RAG

Une pipeline RAG a deux moitiés : le retrieval et la génération. D'abord, vous indexez votre connaissance dans un stockage cherchable, souvent une base de données vectorielle d'embeddings. Au moment de la requête, le système trouve les passages les plus pertinents à la question, les ajoute au prompt, et le modèle génère une réponse à partir de ce contexte ancré.

  • Indexer : découpez vos documents en chunks et stockez-les de façon cherchable par sens, pas seulement par mot-clé.
  • Récupérer : pour chaque question, ramenez la poignée de chunks les plus pertinents.
  • Générer : insérez ces chunks comme contexte dans le prompt et laissez le modèle y répondre.

RAG vs Fine-Tuning

Le RAG et le Fine-Tuning adaptent tous deux un modèle à vos besoins, mais résolvent des problèmes différents. Le Fine-Tuning change les poids du modèle pour lui apprendre un style ou une compétence, et il est lent et coûteux à mettre à jour. Le RAG laisse le modèle intact et le nourrit plutôt de connaissances fraîches au moment de la requête, donc c'est le bon outil quand vos faits changent souvent ou doivent être cités. Beaucoup de systèmes réels utilisent les deux : le Fine-Tuning pour le comportement, le RAG pour la connaissance.

Pourquoi le RAG compte pour les builders

Le RAG est la façon dont la plupart des fonctions d'IA de production restent précises et dignes de confiance. Il laisse un bot de support répondre depuis votre vrai centre d'aide, un agent de recherche citer ses sources et un outil interne raisonner sur des données privées que le modèle de base n'a jamais vues. Parce que le retrieval pilote ce que le modèle lit, le RAG réduit aussi l'hallucination et vous donne un endroit où appliquer les permissions, pour que le modèle reste honnête et ancré dans le contexte autorisé.

Questions fréquemment posées

Étape suivante

Prêt à mettre l’IA au service d’un véritable workflow ?

Commencez par le cours de base, conservez vos progrès localement et synchronisez tout sur votre compte gratuit quand vous le souhaitez.