Oossa

Aleph Alpha addestra un LLM a segnalare le risposte non supportate

Un nuovo addestramento Merlin‑Arthur insegna al modello a dire «non lo so» quando il documento non contiene la risposta, riducendo le allucinazioni fino a 35 punti percentuali.

BreveOossa1 min di lettura

Aleph Alpha ha presentato un metodo per insegnare a un modello linguistico a non rispondere quando il documento fornito non contiene le informazioni necessarie. La tecnica, chiamata protocollo Merlin‑Arthur, mette il modello (Arthur) alla prova con due assistenti: Merlin, che fornisce un passaggio completo, e Morgana, che elimina la frase decisiva. Durante l’addestramento Arthur non sa mai quale dei due ha davanti: impara così a rispondere solo quando sono disponibili prove e ad astenersi in caso contrario. I test condotti su cinque benchmark di domande e risposte mostrano che le risposte errate diminuiscono fino a 35 punti percentuali e che un nuovo «punteggio di ancoraggio» aumenta fino a 0,38.

Perché conta

Offre agli utenti un modo affidabile per capire se una risposta dell’IA proviene davvero dai loro documenti, riducendo il rischio di allucinazioni.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.

Fonti e riferimenti

1 fonti

Ultimo aggiornamento: ·Markdown·llms.txt