# 중국 AI 모델 안전성 평가, 공개된 사례는 3.6%

> Semianalysis가 중국 개발사 9곳의 모델 857개를 조사했습니다. 출시 전후 안전성 평가 결과가 확인된 모델은 31개였습니다.

Oossa · 2026-10-11 · https://oossa.com/ko/ai-3-6

AI 분석기관 Semianalysis의 조사에 따르면, 중국 주요 AI 개발사 9곳이 2021년부터 2026년 9월 15일까지 출시한 모델 857개 가운데 안전성 평가 결과가 모델별로 확인된 것은 31개(3.6%)였습니다. 이 중 출시 시점이나 그 전에 결과를 공개한 모델은 9개(1.1%)뿐이었습니다.

나머지 813개(94.9%) 모델은 공개된 평가 결과를 확인하지 못했습니다. 이는 기업들이 안전성 테스트를 하지 않았다는 뜻은 아닙니다. Semianalysis는 모델 카드와 기술 보고서, 출시 자료 등을 살펴봤으며, 내부 평가를 했더라도 결과를 공개하지 않은 경우에는 공개 실적으로 세지 않았습니다.

## 공개는 늦고, 위험 평가도 부족했다

출시 후 결과를 공개한 사례는 공개까지 걸린 기간이 중앙값 기준 42일이었습니다. 가장 늦은 사례는 출시 349일 뒤에야 결과를 내놨습니다. 특히 추론 모델은 93%에서 공개된 안전성 평가를 찾지 못했습니다.

조사에서 확인한 평가 항목은 유해한 답변, 탈옥 방어, 개인정보 보호, 위험한 요청을 거부하는 능력 등이었습니다. 보고서는 사이버 공격이나 생물학적 위험, 인간 통제 상실 가능성 같은 위험을 포괄적으로 평가한 결과를 공개한 최첨단 텍스트 모델도 확인하지 못했다고 밝혔습니다. 일부 사이버 보안 자료는 실제 공격 능력보다 안전한 코드 생성 능력을 다뤘다고 지적했습니다.

## 기업별 차이도 있었다

조사 대상 중 Z.ai는 2022년 이후 매년 안전성 평가 결과를 공개한 유일한 기업이었습니다. Alibaba는 238개 모델 중 7개, Tencent는 133개 중 1개에 대해 결과를 공개했습니다. DeepSeek는 V3의 출시 시점 평가 자료를 공개했지만, R1과 이후 주요 모델에서는 같은 수준의 공개가 확인되지 않았습니다.

Semianalysis는 중국 정부가 AI 안전 위험을 다룬 지침을 내놓았지만, 모델의 규모나 기능에 따라 개발사에 위험 평가와 결과 공개를 요구하는 체계는 부족하다고 분석했습니다. 다만 이 조사는 공개 자료를 바탕으로 한 것이므로, 각 기업의 비공개 평가가 실제로 얼마나 이뤄졌는지는 보여주지 않습니다.

## 팩트

- Semianalysis는 중국 개발사 9곳의 2021년부터 2026년 9월 15일까지 출시된 모델 857개를 조사했습니다.
- 모델별 안전성 평가 결과가 확인된 것은 31개(3.6%)였고, 출시 시점 또는 그 전에 공개된 것은 9개(1.1%)였습니다.
- 출시 후 결과를 공개한 사례의 공개 시점은 출시일로부터 중앙값 42일 뒤였으며, 가장 긴 기간은 349일이었습니다.
- 추론 모델 가운데 93%는 공개된 안전성 평가 결과가 확인되지 않았습니다.
- Z.ai는 조사 대상 중 2022년 이후 매년 평가 결과를 공개한 유일한 기업이었습니다.

## 왜 중요한가

중국 AI 서비스를 고르는 이용자와 이를 도입하는 기업은 공개 자료만으로 모델의 안전성 검증 수준을 비교하기 어렵습니다. 다만 결과가 공개되지 않았다는 사실만으로 테스트를 하지 않았거나 모델이 안전하지 않다고 단정할 수는 없습니다.

## 출처 및 참고 자료

1. [중국 AI 모델 안전성 평가 공개율 3.6%...출시 전 공개는 고작 1.1%](https://www.aitimes.com/news/articleView.html?idxno=216127) – AI Times, 2026-10-11

최종 업데이트: 2026-10-11
