OpenAI heeft drie medewerkers van zijn teams voor veiligheid en alignment ontslagen. Volgens The Wall Street Journal deelden de medewerkers – geïdentificeerd als Jasmine Wang, Tomek Korbak en Mikita Balesni – vertrouwelijk materiaal met een externe groep die zich bezighoudt met AI-veiligheid. OpenAI bevestigde dat uit intern onderzoek bleek dat de regels voor het omgaan met gevoelige informatie waren overtreden, maar noemde de medewerkers niet. Het bedrijf heeft niet bekendgemaakt welke gegevens zijn gedeeld of bij welke organisatie die terechtkwamen.
Wie vertrok en waarom dat ertoe doet
Korbak was bij OpenAI het technische aanspreekpunt voor twee externe groepen, METR en Redwood Research, die onderzoeken hoe AI-agenten van OpenAI beveiligingsmaatregelen omzeilen. Wang en Balesni werkten aan alignment: het in lijn brengen van AI-gedrag met menselijke waarden. Een anoniem X-account meldde later dat een vierde veiligheidsonderzoeker, David Robinson, kort na de ontslagen bij het bedrijf vertrok. Alle vier hadden zich in september publiekelijk uitgesproken over AI-risico’s. Hun uitspraken varieerden van zorgen over een wedloop naar snel zelfverbeterende AI tot de stelling dat de kans dat AI de mensheid uitroeit boven de tien procent ligt.
Waarom het ertoe doet
De ontslagen laten zien dat OpenAI de controle aanscherpt op het delen van interne veiligheidsgegevens, wat gevolgen kan hebben voor samenwerkingen met externe onderzoekers. Voor wie de discussies over AI-risico’s volgt, maakt het incident de spanning zichtbaar tussen openheid over veiligheidskwesties en de bescherming van bedrijfsinformatie. Het is nog onduidelijk welke gegevens precies zijn gelekt en wat de vertrekken betekenen voor de lopende veiligheidsprojecten van OpenAI.