Aleph Alpha ha valutato 12 LLM cinesi open-weight e ha rilevato che rispondevano in modo equilibrato solo al 17-41 % dei prompt politicamente sensibili. Il test ha segnalato anche Nemotron Cascade 2 di NVIDIA per il 17 % dei prompt: circa 3,5 mila delle sue 9,3 milioni di righe di dati di addestramento contengono argomenti riconducibili alla linea del Partito Comunista Cinese. L’azienda afferma che i modelli futuri filtreranno contenuti di questo tipo, integreranno dati mirati per l’allineamento e useranno benchmark come questo.
Perché conta
Capire i pregiudizi politici nell’IA aiuta utenti e autorità di regolamentazione a valutare quanto questi modelli siano sicuri e neutrali nell’uso quotidiano.