أعلنت Aleph Alpha عن طريقة تدرّب نموذجًا لغويًا على الامتناع عن الإجابة عندما تفتقر الوثيقة المقدمة إلى المعلومات اللازمة. وتضع التقنية، التي تُسمى بروتوكول Merlin‑Arthur، النموذج (Arthur) في مواجهة مساعدَين: Merlin، الذي يقدّم مقطعًا كاملًا، وMorgana، التي تحذف الجملة الحاسمة. وخلال التدريب، لا يعرف Arthur أبدًا أي الطرفين يواجه، فيتعلّم ألا يجيب إلا عندما تكون الأدلة متاحة، وأن يمتنع عن الإجابة خلاف ذلك. وأظهرت الاختبارات على خمسة معايير لأسئلة وأجوبة انخفاض الإجابات الخاطئة بما يصل إلى 35 نقطة مئوية، وارتفاع «درجة الاستناد» الجديدة بما يصل إلى 0.38.
لماذا يهم
تمنح هذه الطريقة المستخدمين وسيلة موثوقة لمعرفة ما إذا كانت إجابة الذكاء الاصطناعي مستندة فعلًا إلى وثائقهم، ما يقلل الهلوسات التي قد تنطوي على مخاطر.