Aleph Alpha a évalué 12 grands modèles de langage chinois à poids ouverts et constaté qu’ils ne répondaient de manière équilibrée qu’à 17 à 41 % des questions politiquement sensibles. Le test a également signalé NVIDIA Nemotron Cascade 2 pour 17 % des questions : environ 3,5 k de ses 9,3 M de lignes de données d’entraînement contiennent des éléments de langage du Parti communiste chinois. L’entreprise indique que ses futurs modèles détecteront ce type de contenu, intégreront des données d’alignement ciblées et s’appuieront sur des évaluations comparatives comme celle-ci.
Pourquoi c'est important
Comprendre les biais politiques de l’IA aide les utilisateurs et les autorités de régulation à déterminer dans quelle mesure ces modèles sont sûrs et neutres au quotidien.