Oossa

Aleph Alpha entraîne un LLM à signaler les réponses non étayées

Un nouvel entraînement Merlin‑Arthur apprend au modèle à répondre « Je ne sais pas » quand un document ne contient pas la réponse, réduisant les hallucinations jusqu’à 35 points.

BrèveOossa1 min de lecture

Aleph Alpha a dévoilé une méthode qui apprend à un modèle de langage à s’abstenir de répondre lorsque le document fourni ne contient pas les informations nécessaires. Baptisée protocole Merlin‑Arthur, cette technique oppose le modèle (Arthur) à deux assistants : Merlin, qui fournit un passage complet, et Morgana, qui en retire la phrase décisive. Pendant l’entraînement, Arthur ignore à qui il a affaire. Il apprend ainsi à répondre uniquement lorsque les éléments nécessaires sont présents et à s’abstenir dans le cas contraire. Des tests menés sur cinq références d’évaluation de questions-réponses montrent que les réponses erronées diminuent jusqu’à 35 points de pourcentage et qu’un nouveau « score d’ancrage » augmente jusqu’à 0,38.

Pourquoi c'est important

Cette méthode permet aux utilisateurs de savoir de manière fiable si la réponse d’une IA provient réellement de leurs propres documents, réduisant ainsi les risques d’hallucinations.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.

Sources et références

1 sources

Dernière mise à jour: ·Markdown·llms.txt