Claude sohbet robotunun arkasındaki şirket Anthropic, insan inceleme ekibinin tehdit içerikli bir konuşmayı kolluk kuvvetlerine bildirdiğini açıkladı. Bildirim, Florida’nın Lee County bölgesinde yaşayan bir kadına ağır suçlama yöneltilmesine yol açtı. Suçlama, toplu silahlı saldırı veya terör tehdidi içeren yazılı ya da elektronik mesajları kapsayan Florida Statute 836.10 kapsamında yapıldı.
Tehdit nasıl tespit edildi?
Anthropic, tehlike oluşturabilecek belirli ifadeler için sohbetleri izliyor. “Carli” adlı bir kullanıcı 26 Eylül’de Lee County Şerif Ofisi’nde “ateş açacağını” yazınca sistem mesajı işaretledi. 27 Eylül’deki takip notunda yeni bir silahtan söz ediliyordu. Kullanılan ifadeler ciddi bulunduğu için inceleme ekibi dosyayı bir insan analiste iletti; analist de şerif ofisini uyardı. Polis, kadını evinde olaysız şekilde gözaltına aldı ve soruşturmayı bir istihbarat dedektifi devraldı.
Bu, yapay zekâ kullanıcıları için ne anlama geliyor?
Anthropic’in politikası, bir konuşma gerçek bir tehdit izlenimi verdiğinde yapay zekâ sağlayıcılarının müdahale edebildiğini ve ettiğini gösteriyor. Şirketin inceleme süreci kamu güvenliğini korumayı amaçlıyor; ancak şiddet niyeti içeren kullanıcı sohbetlerinin incelenebileceği ve yetkililerle paylaşılabileceği anlamına da geliyor.
Neden önemli
Bu olay, sıradan kullanıcılar açısından yapay zekâ sohbetlerinin bütünüyle özel olmadığını; sağlayıcıların şiddet içeren ifadeleri işaretleyip bildirebileceğini gösteriyor. Ayrıca bir sohbet robotuna yöneltilen tehditlerin gerçek dünyada hukuki sonuçlar doğurabileceğini ortaya koyuyor. Ancak Anthropic’in polise ne zaman haber verileceğine karar verirken kullandığı ölçütler net değil.