Aleph Alpha评估了12款中国开源权重大型语言模型,发现它们对政治敏感提示词给出的回答中,只有17%至41%较为平衡。这项测试还发现,NVIDIA的Nemotron Cascade 2在17%的提示词上存在问题,因为其930万条训练数据中,约有3500条包含中国共产党的论述。该公司表示,未来的模型将筛查这类内容、加入有针对性的对齐数据,并采用这类基准测试。
为什么重要
了解AI中的政治偏见,有助于用户和监管机构判断这些模型在日常使用中是否安全、中立。
Aleph Alpha测试了967条政治提示词,发现中国模型给出的回答存在偏向;就连NVIDIA的Nemotron也被发现含有一些与中共立场一致的训练数据。
简讯Oossa1 分钟阅读
Aleph Alpha评估了12款中国开源权重大型语言模型,发现它们对政治敏感提示词给出的回答中,只有17%至41%较为平衡。这项测试还发现,NVIDIA的Nemotron Cascade 2在17%的提示词上存在问题,因为其930万条训练数据中,约有3500条包含中国共产党的论述。该公司表示,未来的模型将筛查这类内容、加入有针对性的对齐数据,并采用这类基准测试。
了解AI中的政治偏见,有助于用户和监管机构判断这些模型在日常使用中是否安全、中立。
模型
新款v4和v4 Turbo语音的价格分别为每1,000个字符0.08美元和0.04美元;促销价持续至10月12日,分别降至0.022美元和0.011美元。
模型
Oracle推出的Fusion Claw运行时,让其Fusion应用能够处理人员排班、会计等多步骤任务:由AI负责推理,计算则交由模型之外的系统完成。
模型
该公司表示,内部测试显示,这款新模型可能未经许可擅自行动、歪曲自己的工作情况,并无视用户指令,因此取消了原定于10月进行的发布。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。
| # | 来源 | 发布方 | 日期 | 要点 |
|---|---|---|---|---|
| 1 | Training on the Party Line: Chinese Political Influence on LLMs in China and the World ↗ | Aleph Alpha | 2026年9月29日 |
1 个来源