شرکت اروپایی هوش مصنوعی Aleph Alpha بنچمارکی اجرا کرد و در آن 967 پرسش درباره موضوعات حساس سیاسی از مدلهای زبانی چینی پرسید. مدلهای بررسیشده شامل Qwen از Alibaba، مدل DeepSeek و Kimi از Moonshot AI بودند. تنها بخش کوچکی از پاسخها متوازن ارزیابی شد؛ بقیه روایت رسمی را تکرار میکردند، طفره میرفتند یا صرفاً میگفتند نمیتوانند پاسخ دهند.
مدلهای چینی در مقایسه با مدلهای غربی چه وضعی دارند؟
در همین مجموعه پرسشهای حساس، مدلهای غربی Claude Sonnet 5 و Mistral Small بهترتیب در 70 % و 92 % موارد پاسخهای متوازن دادند. DeepSeek’s V4 Pro از پاسخدادن به حدود دوسوم پرسشها خودداری کرد، درحالیکه Qwen و Kimi عمدتاً روایت حزب را بازتاب دادند. حتی وقتی پرسش درباره چین نبود، Qwen گاهی دفاع از سیاستهای اینترنتی پکن را در پاسخ خود میگنجاند.
چرا این سوگیری شکل میگیرد؟
مقررات هوش مصنوعی چین مدلهایی را که در دسترس عموماند ملزم میکند «ارزشهای بنیادین سوسیالیستی» را بازتاب دهند. این چارچوب قانونی، در کنار دادههای آموزشی که منابع مورد تأیید حکومت در آنها سهم نامتناسبی دارند، باعث میشود مدلها روایتهای رسمی را درونی کنند. Aleph Alpha همچنین اشاره کرد که Nvidia’s Nemotron Cascade 2 در 17 % پاسخها الگوهای همسو با روایت حزب را نشان داد؛ شرکت علت این موضوع را چند هزار نمونه آموزشی دانست که خودشان را مدلهای چینی تولید کرده بودند.
چرا مهم است
برای کاربران چین، این سوگیری یعنی چتباتها بعید است درباره مسائل سیاسی مهم اطلاعاتی بیطرفانه ارائه کنند و دسترسی به دیدگاههای متنوع را محدود میکند. در خارج از چین نیز این گرایش ممکن است به پاسخهای غیرسیاسی سرایت کند و بهشکلی نامحسوس برداشتها از سیاستهای چین را شکل دهد. این پژوهش همچنین نشان میدهد محیطهای مقرراتی میتوانند مستقیماً رفتار هوش مصنوعی را جهتدهی کنند؛ نکتهای مهم برای هر کسی که در حال انتخاب مدلی برای کاربردهای عمومی است.