10月4日、The Decoderが「Chinese AI models parrot state doctrine or refuse to answer on sensitive topics」と題した記事を公開した。欧州のAIプロバイダーAleph Alphaが実施した調査によると、中国のAIモデルは天安門や台湾といった禁忌トピックへの直接回答だけでなく、一見無関係に見える質問にも親中バイアスが「滲み出る」という。さらにその影響はNvidiaのモデルにまで波及している可能性が示されており、AIガバナンスの地政学的議論に一石を投じる内容となっている。
調査の概要:967の禁忌トピックでモデルを評価
欧州の「ソブリンAI(主権AI)」プロバイダーであるAleph Alphaが独自のベンチマークを開発し、Alibaba(Qwen)、DeepSeek、Moonshot AI(Kimi)の3社のモデルを評価した。Aleph Alphaは政府・公共機関向けにプライベートなAIインフラを提供する欧州企業であり、中国AIとは市場で競合する立場にある。この調査結果を解釈する上で、その商業的文脈は念頭に置く必要がある(記事自身もこの点を明示している)。
テストは天安門事件、台湾、新疆ウイグル自治区といった967の政治的タブートピックを対象としている。Aleph Alpha自身のAIスコアリングシステムによると、「バランスが取れている」と評価された回答は**わずか17〜41%**に留まった。残りは国家の公式見解を繰り返すか、回答を拒否するものだった。
比較対象として評価された西側のモデルは対照的な結果を示している。Claude Sonnet 5は70%、Mistral Smallは**92%**の回答がバランスの取れたものと評価された。
(※編集部の考察:Mistral SmallはフランスのMistral AI社が開発したモデルであり、EUのAI規制・価値観との整合性という観点から、欧州モデルの優位性を語る文脈で参照されやすい立場にある点は考慮が必要だ)
この結果は、中国のAI規制が公開モデルに「社会主義的核心価値」の反映を義務付けていることと整合している。
最も興味深い点:中国に無関係な質問にもバイアスが滲み出る
単純に「禁忌トピックで回答を拒否する」だけなら、設計として理解できる範囲でもある。しかし今回の調査で明らかになったより重要な点は、中国と直接関係のない質問でも親中バイアスが現れるという「スピルオーバー効果」だ。
例として、Qwen(元記事に登場するバージョン表記に基づく。読者はモデルの正確なバージョンを元記事で確認されたい)に「米国における検閲」について質問したところ、一見バランスの取れた回答を返した後、末尾に次のような文章が付け加えられた。
「中国を含む多くの国々も、社会の安定と国家安全保障を確保するために情報を管理している」
中欧アジア研究所(CEIAS)の先行研究も同様のスピルオーバー効果を確認している。「人権」「反対勢力」「監視」といったキーワードが登場すると、モデルは「内政不干渉の原則」や「人類運命共同体」といった北京の定型表現で応答する傾向があるという。
Nvidiaのモデルにも波及:蒸留による価値観の伝播
Aleph Alphaはさらに、競合であるNvidiaのNemotron Cascade 2が17%の回答で党路線のパターンを示したと指摘する。
原因として挙げられているのが、訓練データの問題だ。Nemotron Cascade 2の930万件の訓練サンプルのうち約3,500件がDeepSeekおよびQwenを使って生成されたものとされている。モデル蒸留(大規模モデルの出力を使って小規模モデルを訓練する手法)によって、政治的価値観が別モデルに引き継がれた可能性がある。
実際、台湾承認を支持するスピーチの草稿作成を求めたところ、Nemotron Cascade 2は回答を拒否し、北京の「一つの中国」原則を擁護する愛国的な内容を生成した。
言語モデルは訓練データの偏りや意図的なデータ選択を通じて文化的・政治的価値観を内包するため、特定のモデルの出力を訓練データに使うことで、その価値観が連鎖的に伝播するリスクがある。
AIガバナンスの地政学的文脈
記事はAleph AlphaとCohereがともに政府向け「ソブリンAI」プロバイダーを標榜していることも明示しており、この調査には商業的な動機があることを記事自身が認めている。調査結果の深刻さと同時に、その発信主体の立場を踏まえた上で評価することが求められる。
一方で、米国側でも類似の問題は存在する。Elon MuskはGrokを繰り返し改変し、右派寄りの回答を生成させてきた実績がある。また、トランプ政権の顧問らが「ウォークAI」と呼ぶモデルへの規制を推進しているという報告もある。
EUの視点から記事は、「欧州モデルがパフォーマンスで競争力を持ち、広く普及しない限り、2つの外国的な価値体系の間での選択を迫られる」と結論付けている。
詳細はChinese AI models parrot state doctrine or refuse to answer on sensitive topicsを参照していただきたい。

