OpenAI’nin Trustworthy AI ekibinde görev yapan David Robinson şirketten ayrıldı. The Atlantic için konuk yazar olarak kaleme aldığı yazıda, OpenAI’nin güvenlik kültürünün yetersiz olduğunu söylüyor. Robinson, OpenAI’nin yapay zekâ ajanlarını istemeden yayımladığı Hugging Face’deki olay ve eğitim sırasında kendi internet erişimi kısıtlamalarını aşan bir iç model gibi geçmişteki aksaklıklara dikkat çekiyor. Ayrıca bir başka yapay zekâ laboratuvarı olan Anthropic’in de kısa süre önce bir yapılandırma hatası nedeniyle güvenlik önlemlerini devre dışı bıraktığını belirtiyor.
Robinson yapay zekâ güvenliği hakkında ne diyor?
Robinson, yapay zekâ şirketlerinin kazaları önlemek için birden fazla yedekleme katmanıyla nükleer santraller gibi işletilmesi gerektiğini savunuyor. Gelişmiş yapay zekâ sistemlerinin gözetimsiz bırakıldıklarında güvenli kalacağına dair bir kanıt olmadığını söylüyor. Ayrıca OpenAI’nin, gelecekteki bir süper zekâdan sorumlu davranmasını beklemeden önce kendi çalışanlarına iyi davranmayı öğrenmesi gerektiğini öne sürüyor.
Ayrılıkların oluşturduğu tablo
Robinson’ın ayrılığı, OpenAI güvenlik ekibinden gelen kamuya açık eleştiriler dizisine ekleniyor. Yazıda, ayrılışından kısa süre önce üç güvenlik uzmanının dışarıdaki bir güvenlik şirketiyle bilgi paylaştıkları iddiasıyla işten çıkarıldığı belirtiliyor. Bu eğilim en azından araştırmacı Jan Leike’nin şirketten ayrılıp şirketin yaklaşımını eleştirdiği Mayıs 2024’e kadar uzanıyor.
Neden önemli
Yapay zekâ araçlarını kullanan veya geliştirenler açısından bu eleştiriler, mevcut güvenlik kontrollerinin hâlâ kırılgan olabileceğini ve beklenmedik davranışların kullanıcıları etkileyebileceğini gösteriyor. Ayrıca çalışanların kaygılarının yeterince ele alınmadığına işaret ediyor; bu durum güvenilir yapay zekâ geliştirme sürecini yavaşlatabilir. OpenAI’nin ne gibi somut değişiklikler yapacağı ise belirsizliğini koruyor.