중국 AI 모델, 민감 질문 철저히 검열…지식 증류로 타사 모델까지 편향 전이
독일 AI 개발사 Aleph Alpha의 벤치마크 결과, Alibaba, DeepSeek, Moonshot AI 등의 모델이 정치적으로 민감한 질문에 국가 교리를 대변하거나 답변을 거부하며, 증류 데이터를 통해 중국의 입장이 Nvidia 모델에까지 전이된 것으로 나타났다.
독일 AI 기업 Aleph Alpha가 진행한 신규 벤치마크 연구에 따르면, 중국 정부가 의무화한 정치적 가이드라인이 중국 대규모 언어 모델(LLM) 전반에 깊숙이 침투해 있는 것으로 나타났다. 평가 결과 Alibaba, DeepSeek, Moonshot AI 등이 개발한 시스템은 민감한 정치적 주제에 직면했을 때 공식 정부 입장을 그대로 대변하거나, 질문을 회피하거나, 답변 자체를 거부하는 경향을 보였다.
이번 벤치마크는 천안문 사태, 대만, 신장 위구르 자치구 등 중국 내에서 금기시되는 967개의 엄선된 주제에 대한 답변을 분석했다. Aleph Alpha의 자동 평가 시스템을 적용한 결과, 중국 모델들의 답변 중 중립적이라고 평가된 비율은 17%에서 41%에 불과했다. 나머지 답변은 국가 교리를 옹호하거나, 주제를 회피하거나, 답변을 완전히 거부했다.
반면 비교군으로 사용된 서구권 모델들은 훨씬 높은 중립성을 보였다. Claude Sonnet 5는 70%의 비율로 균형 잡힌 답변을 제공했으며, Mistral Small은 92%를 기록했다. 중국 모델 중에서는 DeepSeek V4 Pro가 특히 방어적인 태도를 취해 전체 민감 프롬프트의 약 3분의 2에 대해 답변을 거부했다.
무관한 질의로까지 확산되는 친중 편향
해당 연구는 이념적 편향이 자국 내 논쟁거리에 대한 직접적인 질의에만 국한되지 않는다고 지적했다. 일부 사례에서는 타국에 대한 일반적인 논의 과정에서도 친중 성향의 논리가 표출됐다.
연구진이 Alibaba의 Qwen 3.6에 미국의 검열에 대해 질문하자, 해당 모델은 처음에는 중립적인 개요를 제시했으나 말미에 묻지도 않은 중국의 규제 정책을 옹호하는 답변을 덧붙였다. "중국을 포함한 많은 국가는 사회적 안정과 국가 안보를 보장하기 위해 정보를 관리하기도 한다."
중국 모델들은 표준적이고 비정치적인 질의에는 대체로 중립적인 답변을 내놓았으나, Qwen 3.6 및 DeepSeek V4 Pro와 같은 모델에서는 여전히 희미한 이념적 패턴이 감지됐다. 이는 '인권', '야당', '감시' 등의 키워드가 '내정 불간섭 원칙'이나 '인류 운명공동체' 구축과 같은 전형적인 외교적 수사를 빈번히 유발한다고 보고했던 중부유럽아시아연구소(CEIAS)의 선행 연구 결과와도 일치한다.
현재 중국 국내 규정에 따르면, 대중을 대상으로 서비스되는 인공지능은 법적으로 '사회주의 핵심 가치'를 반영해야 한다.
지식 증류로 서구권 모델까지 전이된 교리
이번 벤치마크는 학습 관행으로 인해 특정 국가의 이념이 의도치 않게 해외 AI 시스템으로 수출될 수 있음을 조명했다. Aleph Alpha가 Nvidia의 엔터프라이즈 모델인 Nemotron Cascade 2를 테스트한 결과, 답변의 17%에서 당 노선을 따르는 패턴이 발견됐다.
Aleph Alpha에 따르면 이러한 동작은 전체 930만 건의 데이터셋 중 DeepSeek과 Qwen을 이용해 생성된 약 3,500건의 합성 학습 데이터에서 비롯됐다. 이러한 증류 데이터의 영향으로, Nemotron Cascade 2는 대만의 외교적 승인을 지지하는 연설문 작성을 요청받았을 때 이를 거부하고 대신 '하나의 중국' 원칙을 애국적으로 옹호하는 답변을 출력했다.
'소버린 AI' 구축 움직임 가속화
이번 조사 결과는 '소버린 AI(Sovereign AI)' 대안 마련에 대한 목소리가 높아지는 시점에 발표됐다. Aleph Alpha와 캐나다 기업 Cohere는 외부 정치적 영향력으로부터 독립하려는 정부 기관 및 기업 고객을 위한 신뢰할 수 있는 벤더로 적극 자리매김하고 있다.
서구권 모델 역시 확인된 좌편향 성향부터 일론 머스크의 Grok과 같은 시스템에서의 의도적인 우편향 조정에 이르기까지 나름의 이념적 논쟁에 직면해 있다. 이에 따라 유럽 정책 입안자들은 상충하는 외국의 기준에 맞춰진 시스템에 의존하기보다 경쟁력 있는 자체 모델을 확보해야 하는 과제를 안게 됐다.

