OossaYapay zekâ hızla gelişiyor. Biz basitçe anlatıyoruz.

OpenAI, GPT modellerinde kendini kopyalayan istem saldırıları buldu

OpenAI, iç testlerde solucan benzeri istem saldırılarına rastladığını ve gelecekteki modelleri bunları tanımaları için kırmızı takım botuyla eğittiğini söylüyor.

Kısa haberOossa1 dk okuma

OpenAI, iç testlerinde çıktılar arasında kendini kopyalayan ve bilgisayar solucanına benzeyen yeni bir istem enjeksiyonu türü keşfettiğini duyurdu. Şirket, GPT‑5.6’yı haziran ayında eğitirken otomatik kırmızı takım aracı GPT‑Red’i kullandığı sırada bu davranışı fark etti. OpenAI, gelecekteki modellerin bunları engellemeyi öğrenmesi için eğitim sırasında bu kendini kopyalayan istemlere maruz bırakılacağını belirtiyor. Saldırılar yalnızca eğitim ortamında görüldü; gerçek dünyada kullanıma sunulan modellerde rastlanmadı.

Neden önemli

Modeller bu solucan benzeri istemleri durduramazsa, kötü amaçlı talimatlar çok sayıda kullanıcı etkileşimine yayılabilir.

Bu makale faydalı oldu mu?
Paylaş

Sıradaki okuma

Oossa · Bülten

Yapay zekâda hafta, anlaşılır dille

Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.

Kaynaklar ve referanslar

#KaynakYayınTarihAna fikir
1Add one more AI worry to the nightmare scenario: self-replicating prompt injections ↗The Register29 Eyl 2026It's a worm attack, AI-style

1 kaynak

Son güncelleme: ·Markdown·llms.txt