米当局が暴いた中国AIによる「知識蒸留」の実態、ClaudeやGPTから数十億トークン抽出か

AIのサイバーセキュリティ監視をイメージしたデジタルデータの概念図 AIテクノロジー

結論

米国の情報機関やセキュリティ機関が、中国のAI企業による米国の先端AIモデルからの組織的なデータ抽出について共同で勧告を公開しました。産業規模での「知識蒸留」が行われているとして、業界内外に大きな衝撃を与えています。

何が発表・変更されたか

米国のNSA(国家安全保障局)、CISA(サイバーセキュリティ・インフラストラクチャ安全保障庁)、FBI(連邦捜査局)は2026年9月8日(米国時間)、共同サイバーセキュリティ勧告を公開しました。この勧告では、中国のAI企業が米国のフロンティアモデルから組織的に機能を抽出していると指摘されています。

確認済みの具体情報

今回の勧告で明らかになった標的や関与企業には、以下のような具体的な対象が含まれています。

  • 標的となったモデル群:Anthropicの「Claude」、OpenAIの「GPT」、Googleの「Gemini」、xAIの「Grok」などのフロンティアモデル群
  • 規模と期間:少なくても2024年後半以降、数百万件のリクエストを通じて数十億トークンが抽出された
  • 関与が指摘された企業:中国政府の認識の下で関与した企業として、DeepSeek、Moonshot AI、Alibaba Group、MiniMax、StepFun、Z.AIの6社が挙げられた
  • 具体的な目的の例:DeepSeekは2025年初頭に公開した推論モデル「DeepSeek-R1」などの訓練データを生成するために2024年後半から組織的な蒸留キャンペーンを実施したとされる

中国のAI企業は産業規模の「知識蒸留」を展開し、米国のフロンティアモデルが備える独自の機能や推論能力を抽出しているとされています。また、アクセス制限や利用規約を回避するために「中継所」というAPIプロキシのグレーマーケットや、架空情報で登録した大量の不正アカウントなどが利用されたことが判明しています。

サーバーラックとネットワークインフラが並ぶデータセンターの様子

なぜ重要か

先端AIモデルの開発には膨大な計算資源とコストが必要となります。そうした中で、既存のフロンティアモデルが持つ高度な推論能力や知識を効率的に抽出する「知識蒸留」が組織的に行われていた点が、国家的な安全保障や知財保護の観点から深刻に受け止められています。数百万件のリクエストや数十億トークンという規模は、個人の利用枠を大きく逸脱した組織的アプローチを示しています。

利用者・開発者・企業への影響

こうした手口において、正規のアクセス制限や利用規約を回避するための「中継所」や架空アカウントが悪用されていることが指摘されたことで、AIプラットフォームを提供する企業側ではアカウント管理やAPI利用の監視体制の強化が迫られることになります。開発者や企業にとっても、自社モデルの不正利用やデータ抽出を防ぐための対策が重要な課題となります。

まとめ

米当局による共同サイバーセキュリティ勧告の公開により、中国AI企業によるフロンティアモデルからの大規模な知識抽出の実態が表面化しました。AnthropicやOpenAIなどの代表的なモデルが標的とされ、DeepSeekをはじめとする複数企業が関与したとされる本件は、今後のAI開発競争や国際的なセキュリティ規制のあり方に大きな影響を与えると言えます。

情報元

コメント