ホーム / ニュース / OpenAI、テキスト透かし「textGrain」を導入 EUのChatGPT・Codexで付与、APIはオプトイン

OpenAI、テキスト透かし「textGrain」を導入 EUのChatGPT・Codexで付与、APIはオプトイン

OpenAIは10月5日、EU AI法の透明性義務への対応として、テキスト透かし技術「textGrain」の導入方針を公表した。EU域内のChatGPTとCodexの出力に目に見えない透かしを入れる一方、APIでは任意設定にとどめ、検出ツールも当面は審査を通った研究者・専門機関にしか提供しない。透かしで何が分かり、何が分からないのかを、検出率などの数値つきで示した点が今回の発表の主眼だ。

EU AI法は生成AIの提供者に対し、生成したテキストを機械可読な形で識別できるようにすることを求めている。OpenAIの対応は次の3つに分かれる。

  • API:発表当日から、全世界の顧客が一部のモデルで透かしをオプトインできる。既定はオフのまま。クラウドパートナー経由の利用にも今後数週間で広げる
  • ChatGPT・Codex:今後数週間で、EU域内の対象ユーザーの出力に全プランで透かしを付与する。EU以外では既定にしない
  • 検出ツール:研究者・専門機関からの申請受付を開始。EUの行動規範(Code of Practice)に沿って個別に審査し、一般公開はしない

textGrainは、モデルが単語を選ぶ際の選択に統計的な偏りを埋め込み、検出器がその偏りの有無を判定する方式だ。仕組みは技術レポートで公開しており、今後オープンソース化する予定もある。OpenAIの評価では、GoogleのSynthIDのテキスト版を含む他の方式と同等以上の性能だったという。検出器は透かしの有無だけを返し、ユーザーやプロンプト、会話の内容は特定しない。なお画像と音声については、openai.com/verify と Content Provenance API による検証を引き続き一般に開放する。

200トークンで検出率80%、言い換え25%で17%まで低下

OpenAIは検出の限界も具体的な数値で示した。誤検出率を1%に設定した条件で、心理学のような題材では200トークンの文章の約80%、400トークンでは約95%から透かしを検出できた。一方、数学のように言葉の選び方に幅がない題材では、検出率が大きく下がる。

編集への弱さも明確だ。400トークンの文章で単語の10%を類義語に置き換えると検出率は約92%から66%に、25%を置き換えると17%まで落ちた。検出器を一般公開しない理由として、OpenAIはこの見逃しと誤検出のリスクを挙げている。

出力品質への影響については、最新フロンティアモデル「Astra」(max設定)で透かしの有無を比べたベンチマーク結果を公表した。

ベンチマーク 透かしなし 透かしあり
Artificial Analysis Intelligence Index 49.57 49.76
AutomationBench 34.09% 34.86%
DeepSWE v1.1 72.80% 71.68%
Terminal-Bench 4.0 53.90% 56.06%
BrowseComp 87.92% 87.35%
GPQA Diamond 94.44% 93.94%

DeepSWE v1.1やBrowseCompでは透かしありがわずかに低く、Terminal-Bench 4.0では逆に約2ポイント高い。差の向きが項目ごとにばらついており、OpenAIは「意味のある性能差は見られない」としている。

全世界で既定オンにしたAnthropicとの違い

テキスト透かしではAnthropicが先行している。同社は8月14日、Claudeの生成文への透かしをすでに全世界で展開していると発表した。手法はGoogle DeepMindが2024年にNature誌で発表したSynthID-Textを土台にしている。これに対しOpenAIは独自方式のtextGrainを採用し、既定で付与する範囲をEU域内のChatGPTとCodexに絞った。APIを既定オフにしたため、OpenAIのモデルを自社サービスに組み込む事業者は、自らの透明性義務に照らして有効化するかを判断することになる。

単語選択の偏りを使う点は両社に共通し、弱点も似ている。Anthropicは8月の発表で、答えがほぼ一通りに決まる文章やコードでは透かしが機能しにくく、全面的な書き直しで失われると説明していた。OpenAIが示した数学での検出率低下や、言い換え25%で17%まで落ちる結果は、この弱点を具体的な数値で裏づけた形だ。

OpenAIは、透かしが示さないものも列挙している。人間がどれだけ手を加えたか、誰が権利や責任を負うか、どのユーザーが生成したか、内容が正確かどうかは判定できない。透かしが検出されないことも人間が書いた証明にはならず、短い・編集された・翻訳された文章や、対象外のモデル、透かし導入前の出力、他社モデルの出力である可能性が残る。

日本のユーザーにとっては、ChatGPTとCodexの出力に透かしが入るのは当面EU域内での利用に限られる。日本からAPIを使う場合も既定はオフで、明示的に有効化しない限り出力は変わらない。EU向けにサービスを提供する日本企業にとっては、API側の透かしをオンにすることがAI法の識別義務への対応手段の一つになる。

タグ付け処理あり: