OpenAIは、欧州連合(EU)域内のChatGPTおよびCodexが生成するテキストに、不可視の透かしを埋め込む方針だ。ただし同社の検証によれば、語彙の1割を言い換えるだけで検知精度は約66%まで落ち込むという。
重要ポイント
- 透かしは今後数週間で、EUのChatGPTおよびCodexの全プラン利用者に順次展開される。API利用企業ではオプトイン方式を維持。
- 社内評価では、語彙の25%を類義語に置き換えると検知率は17%まで低下。
- 導入当初、検出ツールにアクセスできるのは、承認された研究者と専門機関に限定。
OpenAIの透かし導入スケジュール
同社は月曜日のブログ投稿でこの計画を発表し、今後数週間かけてEU域内の対象ChatGPTおよびCodexユーザー(すべての料金プラン)に透かし機能を展開すると説明した。開始時点では、グローバルでの一律適用には踏み切らない。
一方、同社APIを利用する世界中の開発者は、すでに一部モデルで透かし機能を有効化できる。ただしデフォルト設定はオフのままだ。この動きは、8月2日に適用開始となったEU AI法(AI Act)の表示義務に対応するもの。AI生成テキストを機械的に識別可能にすることがプロバイダーに求められており、既存サービスは12月2日までの遵守が義務づけられている。
関連記事: BinanceのAIエージェント、自然文から戦略を構築 取引手数料は19.99 USDC
textGrain検知技術の限界
OpenAIが採用する「textGrain」と呼ばれる方式は、画面上にマークを表示するのではなく、モデルの単語選択をわずかに偏らせることで統計的なパターンを残し、コピー・再投稿後も検知可能にする仕組みだ。同社は、この手法が社内比較でGoogleのテキスト向け「SynthID」を含む他方式と同等かそれ以上の性能を示したとし、将来的にはオープンソースとして公開する方針も明らかにした。
ただし、編集が入るとシグナルは急速に弱まる。
400トークン程度の文章を使った評価では、単語の1割を類義語に差し替えるだけで、検出率は約92%から66%に低下。25%の単語を置き換えると、検出率は17%まで低下した。文章が短い場合や、数学問題の解答、翻訳文といったケースも検出が難しく、心理学などをテーマにした200トークン程度の文章では、誤検知率1%の設定で検出率は約80%にとどまったという。
ChatGPT向け検出ツールの提供範囲
OpenAIは当面、検出ツールの利用を承認済みの研究者と専門機関に限定する。理由として、透かしが見逃されるリスクや誤検知の問題を挙げている。また、透かしが検出されないからといって「人間が書いた証拠にはならない」と強調し、透かし自体にはユーザーID、アカウント情報、プロンプト内容など、個人を特定し得る情報は含まれないと説明した。
この取り組みは、8月に対話型AI「Claude」によるテキストへ世界規模で透かしを施すと表明したAnthropicに追随する格好だ。同社の決定には一部ユーザーから反発も出ていた。OpenAIも過去にテキスト用透かしを開発していたが、2024年の報道によれば、ユーザーが競合サービスへ流出する懸念などから実装を見送ってきた経緯がある。
OpenAIとAnthropicに加え、Google、Meta、Microsoftなど大手各社は、AI生成コンテンツの透明性向上を掲げるEUの実務規範(コード・オブ・プラクティス)へのコミットメントを表明している。

