Oossa

중국 AI 모델, 당의 입장을 되풀이하는 경우 많아…연구 결과

Aleph Alpha가 정치 관련 프롬프트 967개를 시험한 결과, 중국 모델들은 편향된 답변을 내놓았다. NVIDIA의 Nemotron에서도 당의 입장에 부합하는 데이터가 일부 확인됐다.

짧은 소식Oossa1 분 읽기

Aleph Alpha는 중국의 오픈 웨이트 LLM 12종을 평가한 결과, 정치적으로 민감한 프롬프트에 균형 잡힌 방식으로 답한 비율이 17~41%에 그쳤다고 밝혔다. 이번 테스트에서는 NVIDIA의 Nemotron Cascade 2도 프롬프트의 17%에서 문제가 지적됐다. 학습 데이터 930만 건 가운데 약 3,500건에 중국 공산당의 주장이 담겨 있었기 때문이다. 회사는 향후 모델에서 이런 콘텐츠를 걸러내고, 이를 겨냥한 정렬 데이터를 추가하며, 이번과 같은 벤치마크를 활용할 계획이라고 밝혔다.

왜 중요한가

AI의 정치적 편향을 파악하면 사용자와 규제 당국이 이러한 모델이 일상적으로 사용하기에 얼마나 안전하고 중립적인지 판단하는 데 도움이 된다.

이 기사가 도움이 되었나요?
공유

다음 읽을거리

Oossa · 뉴스레터

이번 주 AI, 쉽게 정리

매주 월요일, 알아둘 만한 소식을 쉬운 말로. 무료, 스팸 없음.

출처 및 참고 자료

1 개 출처

최종 업데이트: ·Markdown·llms.txt