Oossa

Ontslag OpenAI-veiligheidsonderzoekers leidt tot open brief

Drie ontslagen onderzoekers op het gebied van AI-veiligheid ontkennen wangedrag en waarschuwen dat hun vertrek het interne veiligheidswerk bij OpenAI kan afremmen.

Door Gepubliceerd door Oossa: 1 min lezen

ThisisEngineering · Unsplash

OpenAI ontsloeg vorige week drie onderzoekers op het gebied van veiligheid: Jasmine Wang, Tomek Korbak en Mikita Balesni. Volgens het bedrijf hebben ze het beleid geschonden door vertrouwelijke informatie te verwerken. Het drietal reageerde met een open brief waarin het de beschuldigingen verwerpt en waarschuwt dat hun ontslag andere medewerkers ervan kan weerhouden veiligheidszorgen te melden of met externe experts samen te werken.

Wat er in de brief staat

In de brief aan OpenAI’s Safety and Security Committee en adviesgroepen stellen de onderzoekers dat ze binnen de bestaande normen handelden toen ze samenwerkten met externe veiligheidsgroepen. Ze ontkennen interne details over de nieuwste modellen van OpenAI te hebben gelekt, waaronder een verhaal over ‘minder controleerbare architecturen’. Wang zegt dat de vermeende overtreding — toegang tot de e-mail van een bestuurder — ontstond doordat ze per ongeluk een gedelegeerde inbox opende. Ze meldde dit direct.

Reactie van OpenAI

OpenAI heeft niet publiekelijk op de brief gereageerd, maar deelde met TechCrunch een interne memo waarin de bijdragen van de drie medewerkers worden geprezen. Ook staat erin dat het ontslag geen vergelding was voor hun pleidooi voor meer aandacht voor veiligheid. Volgens de memo moedigt het bedrijf medewerkers ‘altijd aan’ om hun zorgen te uiten. OpenAI heeft niet toegelicht welke specifieke regels zijn overtreden of hoe het medewerkers beschermt die contact hebben met externe auditors.

Waarom het ertoe doet

Als medewerkers van OpenAI bang zijn ontslagen te worden omdat ze met externe veiligheidsgroepen praten, kunnen ze risico’s niet meer melden. Daardoor kan het langer duren voordat gevaarlijk modelgedrag wordt ontdekt. Het geschil laat ook zien hoe onduidelijke interne regels het voor onderzoekers lastiger kunnen maken om binnen de sector samen te werken aan veiligheid.

Was dit artikel nuttig?
Delen

Lees ook

Oossa · Nieuwsbrief

De AI-week, uitgelegd

Elke maandag: het nieuws dat ertoe doet, in gewone taal. Gratis, geen spam.