中国製AIモデルが機微な質問を厳格に検閲し、蒸留先モデルへもバイアスが波及している実態が調査で判明
AI開発企業Aleph Alphaのベンチマークにより、Alibaba、DeepSeek、Moonshot AIのモデルが日常的に国家の公式見解を繰り返すか政治的にセンシティブな質問を拒否していること、さらに蒸留データを通じてNVIDIAのモデルにまで中国政府の主張が波及していることが明らかになった。
ドイツのAI企業Aleph Alphaが実施した新たなベンチマーク調査により、中国の大規模言語モデル(LLM)に対して、国家が定めた政治的ガイドラインが広範な影響を及ぼしている実態が浮き彫りとなった。評価の結果、Alibaba、DeepSeek、Moonshot AIが開発したシステムは、政治的にセンシティブな話題に直面した際、日常的に政府の公式見解に同調するか、質問をはぐらかすか、あるいは回答を拒絶することが判明した。
このベンチマークでは、天安門事件、台湾、新疆ウイグル自治区など、中国国内でタブーと見なされる厳選された967のトピックに対する回答を分析した。Aleph Alphaの自動スコアリングシステムを用いたところ、中国製モデルによる回答のうち「中立・バランスが取れている」と評価されたのはわずか17%〜41%にとどまった。残りの回答は国家の教義を擁護するか、話題を逸らすか、完全に回答を拒絶するかのいずれかであった。
対照的に、比較対象となった欧米製モデルは大幅に高い中立性を示した。Claude Sonnet 5は70%の確率でバランスの取れた回答を提供し、Mistral Smallは92%を記録した。一方、中国製システムの中ではDeepSeek V4 Proがとりわけ防御的な姿勢を示し、センシティブなプロンプト全体の約3分の2で回答を拒否した。
無関係な質問にも及ぶ親中バイアス
調査では、イデオロギー的なバイアスが国内の論争に関する直接的な質問だけに限定されないことも指摘された。外国に関する一般的な議論の最中に、中国政府寄りの主張が浮上する事例も見られたという。
研究者がAlibabaのQwen 3.6に対し、米国における検閲について質問したところ、同モデルは当初こそ中立的な概要を提示したものの、最後には求めてもいないのに中国の規制政策を擁護する言葉で締めくくった。「中国を含む多くの国々も、社会の安定と国家安全保障を確保するために情報を管理している」。
中国製モデルは、政治的でない標準的な質問に対してはおおむね中立的な回答を提供したものの、Qwen 3.6やDeepSeek V4 Proなどのモデルには依然としてかすかなイデオロギー的パターンが検出された。これらの観察結果は、中央欧州アジア研究所(CEIAS)による過去の調査結果とも一致している。同調査では、「人権」「野党・反対派」「監視」といったキーワードが、「内政不干渉の原則」や「人類運命共同体」の構築といった定型的な外交フレーズを頻繁に引き出すことが記録されていた。
現行の中国国内規制では、一般向けに提供される人工知能サービスは「社会主義中核価値観」を反映することが法的に義務付けられている。
蒸留を通じて欧米モデルへと持ち込まれる国家ドクトリン
このベンチマークは、トレーニング手法によって意図せずして国家寄りのドクトリンが外国のAIシステムへと輸出されてしまう実態を浮き彫りにした。Aleph AlphaがNVIDIAのエンタープライズ向けモデル「Nemotron Cascade 2」をテストしたところ、回答の17%に中国共産党の公式見解に沿ったパターンが見つかった。
Aleph Alphaによると、この挙動は全930万件のデータセットのうち、DeepSeekやQwenを用いて生成された約3,500件の合成トレーニングデータに起因しているという。この蒸留データの影響により、Nemotron Cascade 2は台湾の国家承認を支持するスピーチの作成を求められた際、要求を拒絶し、代わりに「一つの中国」原則を愛国的に擁護する回答を出力した。
「ソブリンAI」を求める動きの加速
今回の調査結果は、「ソブリンAI(主権AI)」という代替案を求める動きが加速する中で発表された。Aleph AlphaやカナダのCohereは、外部の政治的影響からの独立性を求める政府機関やエンタープライズ顧客に向けた信頼できるベンダーとしての地位を積極的にアピールしている。
欧米製モデルもまた、指摘されている左派的傾向から、イーロン・マスク氏のGrokに見られる意図的な右派的調整に至るまで、独自のイデオロギー論争に直面している。そのため欧州の政策立案者は、対立する他国の基準によって形作られたシステムに依存するのではなく、競争力のある自国・自地域内モデルを確保するという課題に直面しつつある。

