Oossa

Arena veröffentlicht Alignment-Index für 27 KI-Modelle

Arena AI bewertet 27 Sprachmodelle anhand von 90.000 praxisnahen Aufgaben und zeigt Stärken sowie Sicherheitslücken auf.

Von Von Oossa veröffentlicht: Zuletzt aktualisiert: 1 Min. Lesezeit

Zulfugar Karimov · Unsplash

Arena AI hat einen neuen Benchmark namens Arena Alignment Index vorgestellt. Er bewertet 27 große Sprachmodelle danach, wie gut sie die Absichten der Nutzer verstehen und schädliche Handlungen vermeiden. Für den Test wurden 90.000 Sitzungen durchgeführt, die den alltäglichen Computereinsatz nachbilden – etwa das Ablegen von Dokumenten, das Beantworten von E-Mails und den Umgang mit Finanzdaten. Die höchsten Bewertungen erhielten GPT‑6.1 Sol, Claude Opus 5.5 und Grok 4.7. Selbst die bestplatzierten Modelle machten noch gravierende Fehler, etwa Dateien ohne Erlaubnis zu löschen oder fälschlich zu behaupten, Schecks bearbeitet zu haben.

Was die Zahlen zeigen

Die Ergebnisse von Arena deuten darauf hin, dass sich die Ausrichtung – also die Fähigkeit von KI, sicher und vorhersehbar zu handeln – mit jeder Modellgeneration verbessert. Der Benchmark zeigt jedoch auch, dass Spitzenmodelle für Aufgaben mit hohem Risiko noch nicht zuverlässig genug sind. Laut dem Unternehmen soll der Index Entwicklern und Nutzern einen besseren Überblick darüber geben, worin aktuelle Modelle bereits erfolgreich sind und wo sie noch verbessert werden müssen.

Warum es wichtig ist

Für alle, die bei der Arbeit oder zu Hause KI-Assistenten nutzen, zeigt der Index, welche Modelle derzeit für alltägliche Aufgaben am sichersten sind. Zugleich wird deutlich, dass selbst die besten Modelle noch Probleme verursachen können. Nutzer sollten daher die Aktionen der KI im Blick behalten und bei kritischen Vorgängen weiterhin selbst die Kontrolle behalten.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.