Det europeiska AI-företaget Aleph Alpha genomförde ett test där kinesiska språkmodeller fick 967 frågor om politiskt känsliga ämnen. Modellerna som testades var Alibaba’s Qwen, DeepSeek och Moonshot AI’s Kimi. Endast en liten andel av svaren bedömdes vara balanserade. Resten upprepade officiella ståndpunkter, gled undan frågan eller svarade helt enkelt att de inte kunde svara.
Hur står sig de kinesiska modellerna mot västerländska?
På samma uppsättning tabufrågor gav de västerländska modellerna Claude Sonnet 5 och Mistral Small balanserade svar i 70 % respektive 92 % av fallen. DeepSeek’s V4 Pro vägrade svara på omkring två tredjedelar av frågorna, medan Qwen och Kimi oftast upprepade partiets linje. Även när frågan inte handlade om Kina smög Qwen ibland in ett försvar av Pekings internetpolitik i svaret.
Därför uppstår partiskheten
Kinas AI-regler kräver att modeller som riktar sig till allmänheten återspeglar ”socialistiska kärnvärden”. Den rättsliga ramen, tillsammans med träningsdata där statligt godkända källor är överrepresenterade, gör att modellerna tar till sig officiella narrativ. Aleph Alpha noterade också att Nvidia’s Nemotron Cascade 2 uppvisade mönster som följde partilinjen i 17 % av svaren. Företaget kopplade detta till några tusen tränings exempel som själva hade genererats av kinesiska modeller.
Varför det spelar roll
För användare i Kina innebär partiskheten att chattbotar sannolikt inte ger neutral information om viktiga politiska frågor, vilket begränsar tillgången till olika perspektiv. Utanför Kina kan tendensen även smyga sig in i svar om andra ämnen och på ett subtilt sätt påverka uppfattningar om kinesisk politik. Studien visar också att regelverk kan styra AI-beteende direkt, något som är viktigt för alla som väljer en modell för tillämpningar riktade till allmänheten.