قيّمت Aleph Alpha 12 نموذجًا صينيًا مفتوح الأوزان للغات الكبيرة، ووجدت أنها أجابت عن 17–41٪ فقط من الأسئلة الحساسة سياسيًا بطريقة متوازنة. كما رصد الاختبار محتوى مثيرًا للقلق في NVIDIA Nemotron Cascade 2 في 17٪ من الأسئلة، لأن نحو 3.5 آلاف من أصل 9.3 ملايين سجل تدريبي فيه تتضمن نقاطًا تروج لها الشيوعية الصينية. وتقول الشركة إنها ستفحص النماذج المستقبلية لرصد هذا النوع من المحتوى، وستضيف بيانات مواءمة موجهة، وتستخدم معايير اختبار مثل هذا المعيار.
لماذا يهم
يساعد فهم التحيز السياسي في الذكاء الاصطناعي المستخدمين والجهات التنظيمية على تحديد مدى أمان هذه النماذج وحيادها في الاستخدام اليومي.