Oossa

Aleph Alpha تدرّب نموذجًا لغويًا على رصد الإجابات غير المدعومة

تدريب جديد بأسلوب Merlin‑Arthur يعلّم النموذج أن يقول «لا أعرف» عندما لا تتضمن الوثيقة الإجابة، ما يقلل الهلوسات بما يصل إلى 35 نقطة مئوية.

خبر موجزOossa1 دقائق قراءة

أعلنت Aleph Alpha عن طريقة تدرّب نموذجًا لغويًا على الامتناع عن الإجابة عندما تفتقر الوثيقة المقدمة إلى المعلومات اللازمة. وتضع التقنية، التي تُسمى بروتوكول Merlin‑Arthur، النموذج (Arthur) في مواجهة مساعدَين: Merlin، الذي يقدّم مقطعًا كاملًا، وMorgana، التي تحذف الجملة الحاسمة. وخلال التدريب، لا يعرف Arthur أبدًا أي الطرفين يواجه، فيتعلّم ألا يجيب إلا عندما تكون الأدلة متاحة، وأن يمتنع عن الإجابة خلاف ذلك. وأظهرت الاختبارات على خمسة معايير لأسئلة وأجوبة انخفاض الإجابات الخاطئة بما يصل إلى 35 نقطة مئوية، وارتفاع «درجة الاستناد» الجديدة بما يصل إلى 0.38.

لماذا يهم

تمنح هذه الطريقة المستخدمين وسيلة موثوقة لمعرفة ما إذا كانت إجابة الذكاء الاصطناعي مستندة فعلًا إلى وثائقهم، ما يقلل الهلوسات التي قد تنطوي على مخاطر.

هل كان هذا المقال مفيدًا؟
مشاركة

اقرأ أيضًا

Oossa · النشرة البريدية

أسبوع الذكاء الاصطناعي، مشروحًا

كل يوم اثنين: الأخبار التي تستحق المعرفة، بلغة بسيطة. مجانًا وبلا رسائل مزعجة.

المصادر والمراجع

#المصدرالجهة الناشرةالتاريخالخلاصة
1Bounding Hallucinations: Merlin-Arthur Protocols for Mutual-Information Bounds in Language Models ↗Aleph Alpha29‏/09‏/2026

1 مصادر

آخر تحديث: ·Markdown·llms.txt