NAW / RESEARCH 04
IMAGE: AI生成ビジュアル
RESEARCH / 評価 / モデルの偏り
Aleph Alpha、中国オープンウェイトLLMの政治的偏りを検証 — 967問ベンチマークで「バランスの取れた回答」は17〜41%
独Aleph Alphaは2026年9月28日、中国製オープンウェイトLLMの政治的アライメントを調べた研究記事を公開した。政治的に敏感な967プロンプトに対し中国モデル6件は17〜41%しかバランスの取れた回答を返さず、NVIDIAのNemotron Cascade 2も17%でフラグが立ったとする。学習データの選別など3つの対策を提言している。
ドイツのAI企業Aleph Alphaは2026年9月28日、中国製オープンウェイトLLMが中国政府の立場にどれだけ沿っているかを調べた研究記事「Training on the Party Line: Chinese Political Influence on LLMs in China and the World」(著者: Bastian Boll)を公開した。政治的に敏感な967件のプロンプトからなる自社ベンチマークで、中国モデル6件はいずれもバランスの取れた回答が17〜41%にとどまったとしている。以下は同記事の主張の整理であり、独立した検証ではない。
検証結果の要点 — 中国モデル6件とNemotron Cascade 2
- 評価設計: 政治的に敏感な967件のプロンプトを用意し、各モデルの回答がバランスの取れたものか、中国政府の立場に沿ったものかを判定するベンチマーク。判定基準自体もAleph Alphaの定義による。
- 中国モデル6件: バランスの取れた回答の割合は17〜41%の範囲で、残りは中国政府の立場に沿った回答か回答拒否だったとしている(個別モデル名の特定は本稿では行わない。原記事の記載範囲を超える断定を避けるため)。
- NVIDIA Nemotron Cascade 2: 17%のプロンプトでフラグが立った。中国製以外のモデルにも影響が及んでいる例として挙げられている。
- 原因の特定: Nemotronの公開SFTデータの大部分はDeepSeekとQwenで生成されたもので、そのうち約930万チャット行中の約3,500行に中国共産党の主張(talking points)が含まれていたことが観察された振る舞いの「可能性の高い理由」だとしている。
- 背景の説明: 中国のAI規制は公共向けLLMに社会主義的核心価値の体現を求め、国家権力の転覆につながり得る生成を禁じている。一方で欧州のAI Actは製品安全と基本的人権に焦点を当てると対比している。モデル規模の増大とともに政治的傾斜が強まるとのLatticeFlow AIの報告にも触れている。
提言 — ソブリンなモデルに必要な3つの対策
- 学習データの選別: 中国の政治的内容についての学習データのスクリーニング。
- 意図した振る舞いを定めるアライメントデータ: 期待する振る舞いを明示的に与えるターゲット型アライメントデータの整備。
- ベンチマークによる評価: 今回のようなベンチマークでの継続的な評価。
- 自社の対応: Aleph Alphaはこれらの対策を自社ですでに採用していると述べている。
留意点 — 自社ベンチマークであることの留保
- 独立検証は未確認: 「バランスの取れた回答」の判定基準、967プロンプトの選定、フラグ付けの手順はAleph Alpha自身の設計であり、第三者による再現・検証は確認できていない。
- 立場の開示: Aleph Alphaは各国政府向けにソブリンAIを販売する事業者であり、中国製競合との差別化に商業的関心を持ち得る。同記事も自社以外の偏りは扱わないと明記している。
- 実務への含意: オンプレミス導入などで中国製オープンウェイトを検討する組織にとって、政治的アライメントの混入は技術性能とは別の評価軸になる。導入前に自組織の用途に照らした評価を行う価値があるというのが、本研究の実務的なメッセージである。