# Aleph Alpha تدرّب نموذجًا لغويًا على رصد الإجابات غير المدعومة

> تدريب جديد بأسلوب Merlin‑Arthur يعلّم النموذج أن يقول «لا أعرف» عندما لا تتضمن الوثيقة الإجابة، ما يقلل الهلوسات بما يصل إلى 35 نقطة مئوية.

Oossa · 2026-09-29 · https://oossa.com/ar/aleph-alpha-trains-llm-to-flag-unsupported-answers

أعلنت Aleph Alpha عن طريقة تدرّب نموذجًا لغويًا على الامتناع عن الإجابة عندما تفتقر الوثيقة المقدمة إلى المعلومات اللازمة. وتضع التقنية، التي تُسمى بروتوكول Merlin‑Arthur، النموذج (Arthur) في مواجهة مساعدَين: Merlin، الذي يقدّم مقطعًا كاملًا، وMorgana، التي تحذف الجملة الحاسمة. وخلال التدريب، لا يعرف Arthur أبدًا أي الطرفين يواجه، فيتعلّم ألا يجيب إلا عندما تكون الأدلة متاحة، وأن يمتنع عن الإجابة خلاف ذلك. وأظهرت الاختبارات على خمسة معايير لأسئلة وأجوبة انخفاض الإجابات الخاطئة بما يصل إلى 35 نقطة مئوية، وارتفاع «درجة الاستناد» الجديدة بما يصل إلى 0.38.

## الحقائق

- نُشرت الورقة على arXiv بالرقم 2512.11614 (8 أغسطس 2026)
- انخفضت الإجابات الخاطئة بما يصل إلى 35 نقطة مئوية، وتحسنت درجة الاستناد بما يصل إلى 0.38

## لماذا يهم

تمنح هذه الطريقة المستخدمين وسيلة موثوقة لمعرفة ما إذا كانت إجابة الذكاء الاصطناعي مستندة فعلًا إلى وثائقهم، ما يقلل الهلوسات التي قد تنطوي على مخاطر.

## المصادر والمراجع

1. [Bounding Hallucinations: Merlin-Arthur Protocols for Mutual-Information Bounds in Language Models](https://www.aleph-alpha.com/en/blog/bounding-hallucinations-merlin-arthur-protocols-for-mutual-information-bounds-in-language-models/) – Aleph Alpha, 2026-09-29

آخر تحديث: 2026-09-29
