OpenAI、EU向けにAI生成文章の電子透かし「textGrain」導入へ
OpenAI、EU向けにAI文章の電子透かし導入へ

米OpenAIは10月5日(現地時間)、同社のAIモデルが生成する文章に、AI生成であることを機械的に検出するための電子透かしを導入すると発表した。EU(欧州連合)のAI規制「AI Act」への対応で、今後数週間かけてEU域内のChatGPTおよびCodexユーザーに展開する。APIでは世界のユーザーを対象に、対応モデルで任意に有効化できるようにした。

透かし技術「textGrain」の仕組みと性能

透かし技術の名称は「textGrain」で、モデルが単語を選ぶ過程に、人が知覚できない統計的な信号を加える。検出ツールはこの信号を手がかりに、文章にOpenAIの透かしが含まれるかを判定する。同社は技術レポートを公開しており、技術をオープンソースで提供する方針も示した。同社の評価では、Google DeepMindの「SynthID」のテキスト版を含む他の手法と比べ、同等以上の性能だったという。

導入範囲とAPIでの対応

導入範囲は提供形態によって異なる。ChatGPTとCodexではEU域内の対象ユーザーに全プランで適用する一方、開始時点でEU以外には標準適用しない。APIでは10月5日から世界の顧客が、対応モデルで透かし入りの出力を選択できるようになった。初期設定では無効である。OpenAIはクラウドパートナー経由で利用する同社モデルについても、今後数週間で電子透かしを利用可能にする計画だ。

検出精度と技術上の限界

OpenAIは発表で検出精度のデータを公開し、技術上の限界も示した。偽陽性率を1%に設定した評価では、心理学などの文章で電子透かしを検出できた割合は200トークンで約80%、400トークンで約95%だった。数学のように語の選択肢が限られる文章では検出率が大きく低下する。

編集の影響も受ける。400トークンの文章で単語の10%を類義語に置き換えると、検出率は約92%から66%に低下し、25%を置き換えた場合は17%となった。こうした偽陰性や偽陽性の可能性があるため、OpenAIは検出器を当初は一般公開せず、承認した研究者や専門機関に限定して提供する。

出力品質への影響と規制の背景

出力品質については、最新のフロンティアモデル「Astra」を8種類のベンチマークで評価し、透かしの有無による実質的な性能差は見られなかったとしている。

電子透かし導入の背景には、EU AI Act第50条の透明性規則がある。生成AIの提供者に対し、AIが生成・加工したコンテンツを機械可読な形式で識別可能にすることを求めており、関連する透明性義務は2026年8月2日から適用されている。

競合他社の動向

AI生成テキスト向けの電子透かしでは、Google DeepMindが先行している。同社は2024年に「SynthID」をテキストに拡張し、Geminiの文章生成時にトークンの出現確率を調整することで、人には見えない統計的な信号を埋め込む技術を導入した。SynthIDはテキストに加え、画像、音声、動画にも対応している。

Anthropicも2026年8月、Claudeへのテキスト電子透かしの導入を発表した。SynthID-Textをベースとし、次の単語を選ぶ際のランダム性を調整することで統計的なパターンを残す。2026年8月2日以降に投入したClaudeモデルを対象とし、それ以前のモデルについても順次対応を進めている。