Oossa

Aleph Alpha traint LLM om ongefundeerde antwoorden te signaleren

Met de nieuwe Merlin-Arthur-training leert een model ‘Ik weet het niet’ te zeggen als het antwoord niet in een document staat. Zo daalt het aantal hallucinaties met maximaal 35 procentpunt.

Kort berichtOossa1 min lezen

Aleph Alpha heeft een methode uitgebracht die een taalmodel leert geen antwoord te geven wanneer de benodigde informatie ontbreekt in het aangeleverde document. De techniek, het Merlin-Arthur-protocol, zet het model (Arthur) tegenover twee helpers: Merlin, die een volledige passage aanlevert, en Morgana, die de beslissende zin verwijdert. Tijdens de training weet Arthur nooit met welke van de twee hij te maken heeft. Zo leert hij alleen te antwoorden als het bewijs aanwezig is, en zich anders te onthouden. Tests op vijf QA-benchmarks laten zien dat het aantal foute antwoorden met maximaal 35 procentpunt daalt en een nieuwe ‘grounding score’ met maximaal 0,38 stijgt.

Waarom het ertoe doet

Gebruikers krijgen zo een betrouwbare manier om te weten of een AI-antwoord echt afkomstig is uit hun eigen documenten, waardoor het risico op schadelijke hallucinaties afneemt.

Was dit artikel nuttig?
Delen

Lees ook

Oossa · Nieuwsbrief

De AI-week, uitgelegd

Elke maandag: het nieuws dat ertoe doet, in gewone taal. Gratis, geen spam.

Bronnen en referenties

1 bronnen

Laatst bijgewerkt: ·Markdown·llms.txt