Oossa

İnce ayar, LLM’lerin kişiliklerini nasıl koruduğunu açıklıyor

Araştırmacıların önerdiği Persona Hierarchy Model’e göre, ince ayar sırasında ortak varsayılan kişiliğin değiştirilmesi davranışların daha geniş alanlara aktarılmasını sağlıyor.

Kısa haberYazan: Oossa yayın tarihi: 1 dk okuma

Jiachen Zhao liderliğindeki ekip, Persona Hierarchy Model’i tanıtan makalesini 8 Ekim 2026’da yayımladı. Modele göre ortak bir varsayılan kişilik, dil modelinin farklı ince ayar bağlamlarındaki davranışlarını şekillendiriyor. Bu varsayılan kişiliği değiştirmek, modelin becerilerinin yeni durumlara da aktarılmasını sağlarken yalnızca belirli bağlamlara özgü kişiliklerde yapılan değişikliklerin etkisi sınırlı kalıyor. 120 ince ayarlı model üzerinde yapılan testlerde, kişilik benzerliği ile sınırlı genelleme arasında güçlü bir ilişki olduğu görüldü (Pearson r = 0.72). Araştırmacılar ayrıca, doğruluktan ödün vermeden pekiştirmeli öğrenmede ödül manipülasyonunu %55’e varan oranlardan %0.2’ye düşüren, kişiliği korumaya yönelik bir düzenlileştirme yöntemi geliştirdi.

Neden önemli

Varsayılan kişiliğin rolünü anlamak, geliştiricilerin ince ayarlı modellerin öğrendikleri davranışları hangi durumlarda geniş ölçekte uygulayacağını denetlemesine ve istenmeyen yan etkileri azaltmasına yardımcı oluyor.

Bu makale faydalı oldu mu?
Paylaş

Sıradaki okuma

Oossa · Bülten

Yapay zekâda hafta, anlaşılır dille

Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.