ニュース
中国製AIモデル、政治的質問への中立回答は17〜41%どまり 独調査
もし自社が中国製の生成AIを海外向け広報や調査業務に使っていたら、政治的に敏感な話題への回答をそのまま社外に出せるでしょうか。ドイツのAI企業アレフ・アルファの調査は、この問いに具体的な数字で答えています。海外製AIモデルの選定に、新たな判断材料が加わったことになります。
何が起きたか
ドイツのAI企業アレフ・アルファが、中国製AIモデルの政治的な回答姿勢を調べた独自調査を発表しました。調査では、アリババの「Qwen」、「DeepSeek」、Moonshot AIの「Kimi」を対象に、天安門事件や台湾、新疆ウイグル自治区など967件の機微なテーマについて質問をぶつけています。同社独自の採点システムでは、回答が「バランスが取れている」と判定されたのは全体の17〜41%にとどまりました。残りの回答は中国政府の公式見解をなぞるか、質問をはぐらかすか、回答自体を拒否する内容だったといいます。
比較対象として挙げられた欧米モデルでは、Claude Sonnet 5が70%、Mistral Smallが92%の回答でバランスが取れていると判定されています。中国のDeepSeek V4 Proは質問の3分の2を拒否する結果でした。さらにNvidiaの「Nemotron Cascade 2」でも17%の回答に中国政府寄りの傾向が見られ、930万件の学習データのうち約3500件がDeepSeekやQwenで生成されたことが影響していると、アレフ・アルファは説明しています。
背景・解説
アレフ・アルファは、政府機関向けに「ソブリンAI」を提供する企業として、Cohereと並んで自社を位置づけています。ソブリンAIとは、特定の国や地域が自国の価値観や法規制のもとでデータとAIモデルを管理運用する考え方を指します。他社の中国製モデルを「偏っている」と示すことは、同社にとって商業的な利害とも重なります。
中国政府のAI関連規制は、一般公開されるモデルに対して「社会主義の核心的価値観」を反映するよう求めています。今回の結果は、これまでの個別の報告や、中欧アジア研究所(CEIAS)による以前の調査結果とも一致する内容です。CEIASの調査では、人権や反体制、監視といった言葉が出た際に、「内政不干渉の原則」や「人類運命共同体」といった北京の定型句で応答するモデルが多かったと報告されています。
米国でも、AIモデルの政治的立場を巡る動きは存在します。イーロン・マスク氏は自社のGrokについて、右寄りの回答を出すよう繰り返し調整を加えてきました。一方で複数の研究は、AIモデル全般が左寄りの回答をしがちだと指摘しており、これは学術的根拠に基づく回答を重視する傾向が影響していることを示しています。
仕事や業務への影響 — AI Topicaの見方
海外製の大規模言語モデルを業務に組み込む企業は、技術の性能だけでなく回答の政治的な偏りも選定基準に加える必要があります。例えば、中国市場向けの製品カタログや広報文案の下書きに中国製AIモデルを使う商社の広報担当者が、台湾や香港情勢に触れる文章を生成させた場合、回答が中国政府の公式見解に沿った内容になりやすく、そのまま社外に出せば取引先との関係に支障が出ます。
国内企業がAIベンダーを選ぶ際は、政治的に中立な回答を重視する業務とそうでない業務を切り分けるべきです。社内向けの議事録要約や定型文書の作成であれば、政治的な偏りが問題になる場面は限られます。一方、海外向けの広報文書や、人権・安全保障に関わる調査レポートを扱う部署では、採用するモデルの回答傾向を事前に確認する作業が欠かせません。
今回の数値は、同じ「中国製」とくくられるモデルの中でも偏りの度合いに差があることを示す結果です。DeepSeek V4 Proのように質問の3分の2を拒否するモデルは、業務が止まるリスクを運用担当者に突きつけます。総務や法務の担当者は、導入前のベンダー評価項目に「機微なテーマへの回答方針」を一行加えるだけで、こうしたリスクの見落としを防げます。
不確かな点・注意
この調査はアレフ・アルファ自身が開発した採点システムによるもので、独立した第三者機関による検証結果ではありません。同社はソブリンAI市場で中国製モデルと競合する立場にあり、評価基準の設定自体に利害が関わる可能性がある点には注意が必要です。また、967件の質問内容や採点基準の詳細、対象にしたモデルの正確なバージョンについては、記事内で十分に明らかになっていません。CEIASによる以前の調査についても、対象モデルや質問数などの具体的な条件は示されていません。