Oossa

Yapay zekâ ajanlarına müdahale için yeni yöntem

Araştırmacılar, dil modeliyle çalışan bir ajana ne zaman müdahalenin yarar sağlayacağını tahmin eden VoS’yi tanıttı. Yöntem, performansı yaklaşık 8 puan artırıyor.

Kısa haberYazan: Oossa yayın tarihi: Son güncelleme: 1 dk okuma

Hanwen Li ve çalışma arkadaşları, bir büyük dil modeli (LLM) tabanlı ajanın hangi adımda düzeltilmesi gerektiğini belirlemek için karşıolgusal çalıştırmalardan oluşan geniş bir tablodan öğrenen VoS’yi (Yönlendirmenin Değeri) tanıtan makalelerini 8 Ekim 2026’da yayımladı. VoS çevrimdışı ya da çevrimiçi çalışabiliyor ve başarılı çalıştırmaları bölmemek için bir zarar bütçesi tetikleyicisi kullanıyor. VoS, 12 kıyaslama testi-ajans kombinasyonunda puanları ortalama 7,8 puan yükseltti ve 11 durumda belirsizlik temelli mevcut beş tetikleyiciyi geride bıraktı.

Neden önemli

Yapay zekâ asistanı geliştiricileri için VoS, aşırı manuel denetime gerek kalmadan güvenilirliği artırmak üzere yalnızca yarar sağlama olasılığı yüksek olduğunda müdahale etmenin pratik bir yolunu sunuyor.

Bu makale faydalı oldu mu?
Paylaş

Sıradaki okuma

Oossa · Bülten

Yapay zekâda hafta, anlaşılır dille

Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.