ニュース

OpenAIも生成AIテキストに“透かし”を導入へ ~ただし技術的な制約も多し

EUのAI法に対応、日本では強制されず

OpenAI、EU向けにテキストの“透かし”を導入へ

 米OpenAIは10月5日(現地時間)、欧州連合のAI法(EU AI Act)へ対応するため、AI生成テキストにウォーターマーク(透かし)を導入する方針を発表した。EU AI Actは生成AIの提供者に対して、生成したテキストを機械で識別できるようにすることを求めており、同社もこれに従う考えだが、テキストの透かしや検出の技術にはまだ大きな制約があるともしている。

 同社のテキスト透かし技術は「textGrain」と呼ばれており、モデルがテキストを生成する際、単語の選択に統計的なシグナルを埋め込む。検出ツールは単語のチョイスからテキストがOpenAIのモデル由来であるかどうかを判定するわけだ。Anthropicも「Claude」モデルに同様のテキスト透かし技術を導入している。

 OpenAIによると同社のテキスト透かしは、Anthropicのテキスト透かしのベースとなっている「SynthID」のテキスト版などと比べても同等以上の性能を発揮したとのこと。また、透かしの有無による有意な性能差は見られなかったという。

透かしの有無による「Astra」(max)のベンチマーク結果。OpenAIは性能に意味のある差は見られないとしている

 このテキスト透かし技術は、同日より段階的に展開される。オープンソースでの提供も計画されている。

  • API:10月5日より全世界のAPIユーザーに提供。一部のモデルで透かしの付与を選択(オプトイン)できる。既定では無効
  • 「ChatGPT」と「Codex」:今後数週間でEU域内の全プランで、対象となる出力テキストに目に見えない透かしを追加。世界共通の既定にはしない
  • 検出ツール:利用申請の受け付けを開始。当面は承認された研究者や専門機関に限定して提供する

 一方で、同社は透かしの検出に限界があることも強調している。短い文章では十分な検出精度が得られず、とくに数学のように表現の自由度が低い文章では検出率が低くなる。

文章の長さと内容による透かし検出率の違い。短い文章や数学の文章では検出率が低くなる

 さらに、文章の10%を言い換えるだけでも検出率は大きく低下。25%程度編集されると検出率はさらに下がり、AIが生成したかどうかは判別するのが難しくなる。

単語の置き換えが透かしの検出率に与える影響。単語の10%、25%を同義語に置き換えると検出率が低下する

 検出ツールの提供先が当面の間、信頼性の評価に協力できる研究者や専門機関に限られるのは、こうした事情があるためだ。

 また、透かしではわからないことも明示されている。

  • 人間がどれだけ関与したか
  • 誰が権利を持ち、誰が責任を負うか
  • どのユーザーやアカウントが生成したか
  • 内容が正しいかどうか

 透かしが検出されないからといって『人間が書いた』と証明できるわけでもない。

 同社は単一の技術だけで生成コンテンツの検出を行うことは難しいと認めており、C2PA準拠の「Content Credentials」(画像)、「SynthID」(画像と音声)といった技術も組み合わせた多層的なアプローチを採るとしている。