Anthropic, OpenAI en verschillende andere AI-onderzoekslabs houden achter gesloten deuren scenario-oefeningen waarin een ontspoorde AI bijvoorbeeld banken, internetverbindingen, elektriciteitsnetten en watervoorzieningen uitschakelt. Het idee lijkt op de oorlogssimulaties van het Pentagon, waarin reacties op een kernwapenuitwisseling worden getest. De labs zeggen dat de oefeningen hen helpen na te denken over hoe ze moeten reageren als een krachtig AI-systeem zich misdraagt.
Hoe de oefeningen eruitzien
Volgens berichtgeving van Axios stellen de labs interne teams samen die een reeks mogelijke manieren waarop het mis kan gaan, doorlopen. Een woordvoerder van OpenAI vertelde de nieuwssite dat de oefeningen geen voorspellingen zijn, maar hulpmiddelen voor de voorbereiding. De scenario’s lopen uiteen van verstoringen van financiële diensten tot uitval van nutsvoorzieningen. De labs zien het als een oefening in bedrijfscontinuïteit, een gangbare methode voor bedrijven om zich voor te bereiden op grote crises.
Waarom het ertoe doet
Als een krachtige AI niet goed functioneert of wordt misbruikt, kunnen cruciale diensten waarop we vertrouwen — zoals bankieren of elektriciteit — worden verstoord. Met deze oefeningen willen de labs een voorsprong nemen bij het opstellen van reactieplannen, wat de uitval voor gewone gebruikers kan beperken. Het artikel bevestigt echter niet hoe gedetailleerd die plannen zijn en evenmin of ze met toezichthouders of het publiek worden gedeeld.