Aleph Alpha оценила 12 китайских LLM с открытыми весами и выяснила, что на политически чувствительные запросы они давали сбалансированные ответы лишь в 17–41% случаев. В ходе тестирования также обратили внимание на NVIDIA Nemotron Cascade 2: в 17% запросов модель показала отклонения, поскольку около 3,5 тыс. из 9,3 млн строк обучающих данных содержат тезисы Коммунистической партии Китая. Компания заявляет, что в будущих моделях будет отсекать такой контент, добавлять специальные данные для выравнивания ответов и использовать подобные тесты.
Почему это важно
Понимание политической предвзятости ИИ помогает пользователям и регулирующим органам оценивать, насколько эти модели безопасны и нейтральны для повседневного использования.