Oossa

Aleph Alpha, dayanaksız yanıtları işaretleyen LLM eğitti

Yeni Merlin‑Arthur eğitimi, belgede yanıt bulunmadığında modelin “Bilmiyorum” demesini sağlıyor ve halüsinasyonları 35 puana kadar azaltıyor.

Kısa haberOossa1 dk okuma

Aleph Alpha, sunulan belgede gerekli bilgi yoksa bir dil modeline yanıt vermeyi reddetmeyi öğreten bir yöntem yayımladı. Merlin‑Arthur protokolü adı verilen teknik, modeli (Arthur) iki yardımcıyla karşı karşıya getiriyor: Eksiksiz bir pasaj sunan Merlin ve belirleyici cümleyi çıkaran Morgana. Eğitim sırasında Arthur hangi tarafla karşı karşıya olduğunu hiçbir zaman bilmiyor; böylece yalnızca kanıt bulunduğunda yanıt vermeyi, aksi durumda ise yanıt vermekten kaçınmayı öğreniyor. Beş soru-cevap kıyaslamasında yapılan testler, yanlış yanıtların 35 yüzde puana kadar azaldığını, yeni bir “temellendirme puanının” ise 0,38’e kadar yükseldiğini gösteriyor.

Neden önemli

Bu yöntem, kullanıcıların bir yapay zekâ yanıtının gerçekten kendi belgelerindeki bilgilere dayanıp dayanmadığını anlamasını sağlayarak riskli halüsinasyonları azaltıyor.

Bu makale faydalı oldu mu?
Paylaş

Sıradaki okuma

Oossa · Bülten

Yapay zekâda hafta, anlaşılır dille

Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.

Kaynaklar ve referanslar

1 kaynak

Son güncelleme: ·Markdown·llms.txt