Retrieval-Augmented Generation (RAG) indica un’architettura che permette a un modello linguistico di generare una risposta utilizzando informazioni recuperate da fonti selezionate, come documenti aziendali, manuali, procedure, cataloghi, pagine web o basi di conoscenza interne.
In termini pratici, invece di affidarsi soltanto alle informazioni apprese durante l’addestramento, il modello riceve contenuti pertinenti al momento della domanda. Può quindi formulare una risposta basata su dati aziendali più specifici e aggiornabili.
Un sistema RAG combina due operazioni: il recupero delle informazioni e la generazione della risposta. Il processo può variare in base alla tecnologia utilizzata, ma in genere comprende questi passaggi:
Un’implementazione ben progettata può anche mostrare le fonti utilizzate, limitare la ricerca ai documenti accessibili all’utente e dichiarare quando non dispone di informazioni sufficienti.
La RAG è particolarmente utile quando un chatbot, un assistente o un agente AI deve lavorare con conoscenze specifiche dell’organizzazione. Alcune applicazioni possibili sono:
La RAG può essere uno dei componenti di agenti AI personalizzati per le PMI, ma non trasforma automaticamente un chatbot in un agente autonomo. Un agente può includere anche strumenti, regole operative, autorizzazioni, memoria e collegamenti con altri software.
La RAG fornisce al modello informazioni pertinenti durante l’utilizzo. Il fine-tuning, invece, modifica il comportamento di un modello attraverso un ulteriore addestramento su esempi selezionati.
La RAG è spesso più adatta quando i contenuti cambiano nel tempo o devono essere collegati a fonti consultabili. Il fine-tuning può essere valutato quando occorre rendere più stabile uno stile, un formato di risposta o uno specifico comportamento. Le due tecniche possono anche essere combinate, ma rispondono a esigenze differenti.
Il principale vantaggio è la possibilità di aggiornare la conoscenza disponibile intervenendo sulle fonti e sull’indice, senza dover riaddestrare ogni volta il modello. Inoltre, un sistema RAG può circoscrivere le risposte a un insieme di documenti controllati e rendere più semplice la verifica delle informazioni quando vengono riportati i riferimenti utilizzati.
Questo approccio può migliorare la pertinenza delle risposte, ma non garantisce da solo accuratezza assoluta. Il risultato dipende dalla qualità dei documenti, dal sistema di ricerca, dalle istruzioni date al modello e dai controlli previsti nel flusso.
Un sistema RAG può recuperare il documento sbagliato, ignorare un passaggio importante o interpretare male una fonte corretta. Il modello può inoltre generare affermazioni non supportate dai contenuti ricevuti. Per questo è utile prevedere soglie di rilevanza, citazioni, verifiche, test su domande reali e una risposta prudente quando le informazioni non sono sufficienti.
Un altro problema frequente è la qualità dell’archivio. Documenti duplicati, obsoleti, contraddittori o privi di una responsabilità editoriale rendono meno affidabile l’intero sistema. Prima della tecnologia serve quindi una gestione chiara della conoscenza aziendale.
La presenza di documenti interni richiede attenzione a dati personali, informazioni riservate, tempi di conservazione e autorizzazioni. Il sistema non dovrebbe recuperare un contenuto soltanto perché è stato indicizzato: deve anche verificare se l’utente ha il diritto di consultarlo.
Occorre inoltre valutare dove vengono elaborati i dati, quali fornitori sono coinvolti e quali informazioni vengono registrate. La scelta tra servizi cloud, infrastrutture private e modelli eseguiti internamente dipende dai requisiti del progetto. Un approfondimento utile è il confronto tra AI online e AI in locale.
Per una PMI è prudente partire da un caso d’uso circoscritto, con fonti affidabili e un gruppo definito di utenti. Prima dello sviluppo conviene chiarire:
La RAG non sostituisce l’organizzazione dei processi: la rende interrogabile attraverso il linguaggio naturale. Per questo dovrebbe essere inserita in un progetto più ampio di gestione della conoscenza e, quando opportuno, di automazione AI dei processi aziendali.