IT
Glossario dell'intelligenza artificiale

Cos'è il RAG (Retrieval-Augmented Generation)?

Termine3 minimo lettoAggiornato 3 luglio 2026

In breve

Il RAG, abbreviazione di Retrieval-Augmented Generation, è una tecnica che dà a un modello di IA, al momento della tua domanda, informazioni pertinenti da leggere, così la sua risposta sia ancorata a documenti reali e aggiornati invece che solo a ciò che ha memorizzato durante l'addestramento. Invece di sperare che il modello conosca già i tuoi dati, un sistema RAG recupera prima gli estratti più pertinenti da una sorgente di conoscenza (i tuoi documenti, un database, un insieme di PDF), li inserisce come contesto nel prompt, poi chiede al modello di rispondere con questo materiale. Il risultato: risposte che citano i tuoi contenuti reali, restano aggiornate man mano che i tuoi dati cambiano e allucinano di meno, senza il costo di un riaddestramento del modello.

Come funziona il RAG

Una pipeline RAG ha due metà: il retrieval e la generazione. Prima, indicizzi la tua conoscenza in un archivio cercabile, spesso un database vettoriale di embedding. Al momento della query, il sistema trova i passaggi più pertinenti alla domanda, li aggiunge al prompt, e il modello genera una risposta a partire da questo contesto ancorato.

  • Indicizzare: dividi i tuoi documenti in chunk e archiviali in modo cercabile per significato, non solo per parola chiave.
  • Recuperare: per ogni domanda, riporta la manciata di chunk più pertinenti.
  • Generare: inserisci questi chunk come contesto nel prompt e lascia che il modello vi risponda.

RAG vs Fine-Tuning

Il RAG e il Fine-Tuning adattano entrambi un modello ai tuoi bisogni, ma risolvono problemi diversi. Il Fine-Tuning cambia i pesi del modello per insegnargli uno stile o una competenza, ed è lento e costoso da aggiornare. Il RAG lascia il modello intatto e lo nutre invece di conoscenza fresca al momento della query, quindi è lo strumento giusto quando i tuoi fatti cambiano spesso o devono essere citati. Molti sistemi reali usano entrambi: il Fine-Tuning per il comportamento, il RAG per la conoscenza.

Perché il RAG conta per chi costruisce

Il RAG è il modo in cui la maggior parte delle funzioni di IA di produzione resta precisa e degna di fiducia. Lascia che un bot di supporto risponda dal tuo vero centro assistenza, un agente di ricerca citi le sue fonti e uno strumento interno ragioni su dati privati che il modello di base non ha mai visto. Poiché il retrieval pilota ciò che il modello legge, il RAG riduce anche l'allucinazione e ti dà un posto dove applicare i permessi, così il modello resti onesto e ancorato al contesto autorizzato.

Domande frequenti

Prossimo passo

Pronto a far funzionare l'intelligenza artificiale come un vero flusso di lavoro?

Inizia con il corso di base, mantieni i tuoi progressi localmente e sincronizza tutto con il tuo account gratuito quando vuoi.