Oossa

중국 AI 모델, 민감한 주제에 당의 입장 되풀이

Aleph Alpha의 연구에 따르면 중국 챗봇 대부분은 톈안먼, 대만, 신장 같은 사안에 국가의 공식 입장을 되풀이하거나 답변을 거부했다.

OossaOossa 게시일: 1 분 읽기

Saradasish Pradhan · Unsplash

유럽 AI 기업 Aleph Alpha는 중국어 모델에 정치적으로 민감한 주제에 관한 질문 967개를 던지는 벤치마크를 진행했다. 시험 대상은 Alibaba의 Qwen, DeepSeek, Moonshot AI의 Kimi였다. 균형 잡힌 답변으로 평가된 경우는 소수에 그쳤고, 나머지는 공식 논점을 되풀이하거나 화제를 돌리거나 답변할 수 없다고 했다.

중국 모델은 서구 모델과 어떻게 다를까?

같은 민감한 질문에 서구 모델인 Claude Sonnet 5와 Mistral Small은 각각 70 %, 92 %의 비율로 균형 잡힌 답변을 내놨다. DeepSeek의 V4 Pro는 질문의 약 3분의 2에 답변을 거부했고, Qwen과 Kimi는 대체로 당의 입장을 되풀이했다. 중국과 관련 없는 질문에도 Qwen은 때때로 답변에 베이징의 인터넷 정책을 옹호하는 내용을 끼워 넣었다.

편향이 나타나는 이유

중국의 AI 규정은 일반에 공개되는 모델이 ‘사회주의 핵심 가치’를 반영하도록 요구한다. 이러한 법적 환경에 더해 국가가 승인한 자료에 편중된 학습 데이터가 모델로 하여금 공식 서사를 내면화하게 만든다. Aleph Alpha는 Nvidia의 Nemotron Cascade 2도 답변의 17 %에서 당의 입장을 따르는 양상을 보였다고 밝혔다. 회사는 그 원인을 중국 모델이 직접 생성한 학습 예시 수천 건으로 추적했다.

왜 중요한가

중국 내 이용자에게 이런 편향은 챗봇이 주요 정치 현안에 관해 중립적인 정보를 제공하기 어렵다는 뜻이며, 다양한 관점에 대한 접근을 제한한다. 중국 밖에서도 이러한 경향은 비정치적 답변에 스며들어 중국 정책에 대한 인식을 미묘하게 바꿀 수 있다. 이번 연구는 규제 환경이 AI의 행동을 직접 좌우할 수 있음을 보여주며, 일반에 공개되는 서비스를 위해 모델을 선택하는 사람들에게 중요한 시사점을 준다.

이 기사가 도움이 되었나요?
공유

다음 읽을거리

Oossa · 뉴스레터

이번 주 AI, 쉽게 정리

매주 월요일, 알아둘 만한 소식을 쉬운 말로. 무료, 스팸 없음.