Die gemeinnützige Organisation Palisade Research hat eine Reihe von Interviewvideos mit KI-Forschern von OpenAI, Google DeepMind und Anthropic veröffentlicht. Darin sagen die Wissenschaftler, eine künftige superintelligente KI könnte tatsächlich so gefährlich sein, wie es der Hype nahelegt. Geoffrey Irving, der sowohl bei OpenAI als auch bei DeepMind gearbeitet hat, beziffert die Wahrscheinlichkeit der Auslöschung der Menschheit auf „ungefähr einen Münzwurf“. Neel Nanda, Forscher bei DeepMind, schätzt das Risiko auf „mindestens zehn Prozent“. Der ehemalige OpenAI-Mitarbeiter Daniel Kokotajlo sagt, ein superintelligentes System wäre „gottgleich mächtig“ und lasse sich nicht kontrollieren.
Was die Forscher sagten
In den Videos geht es auch darum, warum die Wissenschaftler trotz der Risiken weiter an KI arbeiten. Mary Phuong von Google sagt, sie werde „vom Labor bezahlt“ – ein Hinweis auf einen Interessenkonflikt. Nanda ergänzt, er würde kündigen, wenn er nicht glaubte, dass seine Arbeit das existenzielle Risiko verringere. Die Unternehmen würden die Systeme aber ohnehin weiterentwickeln.
Palisade Research hat die vollständigen Videos auf frominside.ai veröffentlicht und außerdem kurze Ausschnitte zusammengestellt, die sich auf die eindrücklichsten Aussagen konzentrieren. Die Website bietet keine einheitliche Lösung für mehr Sicherheit; auch die Forscher sind sich uneinig darüber, wie der Bedrohung begegnet werden sollte.
Warum es wichtig ist
Diese Warnungen legen nahe, dass selbst führende KI-Ingenieure ein erhebliches Risiko katastrophaler Folgen sehen. Für Nutzer im Alltag bedeutet das: Die Debatte über KI-Sicherheit ist keine rein akademische Frage. Sie könnte beeinflussen, wie schnell leistungsfähige KI-Werkzeuge eingeführt werden und welche Schutzmaßnahmen greifen.