# Aleph Alpha, dayanaksız yanıtları işaretleyen LLM eğitti

> Yeni Merlin‑Arthur eğitimi, belgede yanıt bulunmadığında modelin “Bilmiyorum” demesini sağlıyor ve halüsinasyonları 35 puana kadar azaltıyor.

Oossa · 2026-09-29 · https://oossa.com/tr/aleph-alpha-trains-llm-to-flag-unsupported-answers

Aleph Alpha, sunulan belgede gerekli bilgi yoksa bir dil modeline yanıt vermeyi reddetmeyi öğreten bir yöntem yayımladı. Merlin‑Arthur protokolü adı verilen teknik, modeli (Arthur) iki yardımcıyla karşı karşıya getiriyor: Eksiksiz bir pasaj sunan Merlin ve belirleyici cümleyi çıkaran Morgana. Eğitim sırasında Arthur hangi tarafla karşı karşıya olduğunu hiçbir zaman bilmiyor; böylece yalnızca kanıt bulunduğunda yanıt vermeyi, aksi durumda ise yanıt vermekten kaçınmayı öğreniyor. Beş soru-cevap kıyaslamasında yapılan testler, yanlış yanıtların 35 yüzde puana kadar azaldığını, yeni bir “temellendirme puanının” ise 0,38’e kadar yükseldiğini gösteriyor.

## Gerçekler

- Makale arXiv’de 2512.11614 numarasıyla yayımlandı (8 Ağustos 2026)
- Yanlış yanıtlar 35 yüzde puana kadar azaldı; temellendirme puanı 0,38’e kadar yükseldi

## Neden önemli

Bu yöntem, kullanıcıların bir yapay zekâ yanıtının gerçekten kendi belgelerindeki bilgilere dayanıp dayanmadığını anlamasını sağlayarak riskli halüsinasyonları azaltıyor.

## Kaynaklar ve referanslar

1. [Bounding Hallucinations: Merlin-Arthur Protocols for Mutual-Information Bounds in Language Models](https://www.aleph-alpha.com/en/blog/bounding-hallucinations-merlin-arthur-protocols-for-mutual-information-bounds-in-language-models/) – Aleph Alpha, 2026-09-29

Son güncelleme: 2026-09-29
