OpenAI、EUでChatGPT生成テキストに不可視の電子透かし「textGrain」を導入へ。API経由では世界中で利用可能に

デジタルテキストに埋め込まれた不可視の透かしを表現したイメージ AIテクノロジー

結論:EU AI法への準拠に向けた新たな一歩

OpenAIは、欧州連合(EU)における「EU AI法(EU AI Act)」の規制に準拠するため、ChatGPTおよびCodexが生成するテキストに対して、不可視のウォーターマーク(電子透かし)の追加を開始することを発表しました。この取り組みは、AIによって生成されたコンテンツを識別可能にすることを目的としており、まずはEU域内のユーザーを対象に展開されます。

発表の背景と展開スケジュール

今回の対応は、EU AI法の「透明性ルール」に基づいています。このルールは8月2日に発効しており、AI企業に対し、他のシステムがAI生成コンテンツであることを識別できるような方法でマークを付与することを義務付けるものです。

OpenAIの発表によると、このウォーターマーク機能は今後数週間にわたり、EU内のすべてのプラン(無料プランおよび有料プランを含む)の対象となるChatGPTおよびCodexユーザーに向けて順次ロールアウトされる予定です。ただし、この自動付与の対象はEU域内に限定されます。

一方で、APIを利用する開発者向けには異なるアプローチが取られています。世界中のOpenAI APIを使用している開発者は、本日より特定のモデルにおいて、このウォーターマーク機能を手動で有効に(オンに)することができます。なお、APIにおける同機能はデフォルトでは「オフ」に設定されています。

不可視の電子透かし「textGrain」の仕組み

欧州のAI規制とデータセキュリティを象徴するイメージ

OpenAIが採用したテキストウォーターマーク技術は「textGrain」と呼ばれます。この技術は、モデルがテキストを出力する際の単語の選択(語彙の選択)を微妙に調整することによって機能します。これにより、人間の目には見えないものの、専用の検出器(デテクター)によって識別可能なパターンがテキスト内に埋め込まれます。

このパターンの最大の特徴は、テキストがコピー&ペーストされて別の場所に貼り付けられた場合でも、テキストデータと共にその特徴が維持される点にあります。

検出精度の限界と実用上の課題

しかし、この「textGrain」技術にはいくつかの技術的な限界や課題も存在します。OpenAIの検証データによると、テキストが改変された場合の検出精度は以下のように低下します。

  • 類義語による書き換えの影響:生成されたテキストの10%の単語を類義語に置き換えた場合、検出率は約92%から66%へと低下します。さらに、単語の25%を類義語に置き換えた場合、検出率は17%にまで低下します。
  • テキストの性質による影響:短い文章、数学の回答、および翻訳されたテキストについては、検出がより困難であることが確認されています。

検出器の提供範囲と今後の影響

こうした技術的な制限があることから、OpenAIはウォーターマークを検出するための「検出器(デテクター)」へのアクセスについて、初期段階では承認された研究者および専門組織のみに限定して提供することを決定しました。

まとめ

OpenAIによる「textGrain」の導入は、法規制への適応という観点から極めて重要なマイルストーンです。コピー&ペーストに耐えうる不可視の透かし技術は画期的である一方、類義語への置き換えや短い文章における検出精度の低下といった実用上の課題も浮き彫りになっています。今後、AI生成コンテンツの透明性を確保するための技術がどのように進化し、グローバルに普及していくのか、その動向が注目されます。

情報元

コメント