Oossa

研究发现,中国AI模型常复述中共立场

Aleph Alpha测试了967条政治提示词,发现中国模型给出的回答存在偏向;就连NVIDIA的Nemotron也被发现含有一些与中共立场一致的训练数据。

简讯Oossa1 分钟阅读

Aleph Alpha评估了12款中国开源权重大型语言模型,发现它们对政治敏感提示词给出的回答中,只有17%至41%较为平衡。这项测试还发现,NVIDIA的Nemotron Cascade 2在17%的提示词上存在问题,因为其930万条训练数据中,约有3500条包含中国共产党的论述。该公司表示,未来的模型将筛查这类内容、加入有针对性的对齐数据,并采用这类基准测试。

为什么重要

了解AI中的政治偏见,有助于用户和监管机构判断这些模型在日常使用中是否安全、中立。

这篇文章有帮助吗?
分享

继续阅读

Oossa · 新闻简报

一周 AI,讲明白

每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。

来源与参考

1 个来源

最后更新: ·Markdown·llms.txt