メニュー

AI

OpenAIがChatGPTとCodexの出力に電子透かし:EU限定の導入と、検出の限界

OpenAIが、EUのAI法に対応するため、EU圏のChatGPTとCodexの文章に目に見えない電子透かし(textGrain)を入れると発表しました。透かしの仕組みと、書き換えや短文で検出率が落ちる点、企業での使い方を整理します。

公開
茹で時間
8 分
言語
日本語 · English

この記事でわかること

  • OpenAIは、EUのAI法に対応するため、EU圏のChatGPTとCodexの文章に、目に見えない電子透かし「textGrain」を数週間かけて入れる。EU以外では初期設定にしない
  • APIは、対象モデルについて世界中の利用者がオプトインで使える。初期設定は無効
  • 検出器は公開せず、承認された研究者と専門機関だけに提供する。400トークンの文章で10%を同義語に置き換えると、検出率は約92%から約66%に下がる
  • 透かしがないことは、人間が書いた証拠にならない。社内の文書審査やAI利用の方針に使うときは、この限界を前提にしたい
目次
  1. どこに、いつ入るか
  2. 透かしの仕組み
  3. Anthropicとの違い
  4. 画像・音声は、すでに検出ツールが公開されている
  5. 検出の限界
  6. 企業で使うときに考えたいこと

OpenAIは2026年10月5日、EU圏のChatGPTとCodexの文章に、目に見えない電子透かしを入れると発表しました。EUのAI法が、生成AIの提供者に、生成した文章を機械で識別できるようにすることを求めているためです。気になるのは、透かしで何が分かり、何が分からないのかです。OpenAI自身が検出率の数字と「透かしが示さないこと」を公開しているので、そこから読みます。

どこに、いつ入るか

OpenAIの発表では、対象と時期は3つに分かれています。

  • ChatGPTとCodex: EUの利用者に限り、全プランで数週間かけて導入する。「グローバルの初期設定にはしない」と説明している
  • API: 対象モデルについて、世界中の利用者が発表の当日からオプトインできる。初期設定は無効のまま
  • 検出器: 承認された研究者と専門機関に申請を受け付ける。公開はしない。The Vergeによると、クラウドパートナー経由で提供するOpenAIのモデルの出力にも、数週間のうちに透かしを使えるようにする

EUの外でChatGPTを使う人の文章には、当面は透かしが入りません。一方、APIで業務システムを組んでいる企業は、EU圏外でも自分の判断で有効にできます。

透かしの仕組み

OpenAIが使う「textGrain」は、モデルが次の単語を選ぶときの偏りに、見えない統計的な信号を入れる方式です。検出器はその信号を探して、文章にOpenAIの透かしが含まれるかを判定します。記号や特殊な文字を足すわけではないので、コピー&ペーストでも信号は残ります。透かしは利用者を特定せず、プロンプトも含みません。

OpenAIは方式の数学的な詳細を、報告書「textGrain: Entropy-Calibrated Watermarking for Language Model Text」にまとめ、発表と同じ日にPDFで公開しました。OpenAIの5人と、ペンシルベニア大学・イェール大学の研究者4人の共著で、OpenAIは内容を今後数週間のうちに追加するとしています。

報告書の方式は、モデルが次のトークン(単語やその一部)を選ぶとき、秘密の鍵と直前の文脈から決まる擬似乱数に、選び方を結びつけます。結びつけ方は、最適輸送という数学の問題として解いています。結びつきを強くするほど、モデルの選択肢の幅(エントロピー)が失われるため、失ってよい量に上限(予算)を決めて、透かしの強さを調整します。語彙をいくつかのブロックに分けて計算量を減らしているのも特徴です。検出器に必要なのは文章と鍵だけで、生成時の上限は知らなくてかまいません。偏りは1トークンずつでは小さく、文章が長いほど足し合わさって検出しやすくなります。OpenAIは、この技術のオープンソースでの公開も予定しています。

Anthropicとの違い

OpenAIは自社の方式を、Google DeepMindのSynthID(文章版)と比べて「同等以上」としています。Anthropicが8月に発表したClaudeの透かしも、SynthID(文章版)の方式を使っています。次の単語を選ぶときの乱数の元を、鍵と直前の数語から決める仕組みで、文字や追加のトークンは入りません。2社には、対応の違いがあります。

  • 適用する地域: Anthropicは、地域ごとに切り分ける方法がまだないとして、最初から世界中のClaudeに適用した。OpenAIはEUのChatGPTとCodexに限る
  • 検出器: Anthropicは検出用のAPIを用意する計画。OpenAIは、承認された研究者と専門機関だけに提供する
  • 透かしが入りにくいもの: Anthropicは、答えが1つに決まる事実や、正確さが必要なコードには透かしが入りにくいと説明している。OpenAIの検出率の数字でも、数学のように言い回しの自由度が小さい内容は検出率が下がる

どちらの検出も、文章が短いほど、編集や翻訳が入るほど、信頼性が落ちるという点は共通しています。

品質への影響について、OpenAIは最新モデルAstraのベンチマークで比べ、透かしの有無で大きな差はなかったとしています。たとえば、Artificial Analysis Intelligence Indexは49.57点(透かしなし)と49.76点(あり)です。

画像・音声は、すでに検出ツールが公開されている

OpenAIは文章より先に、画像と音声の出どころの表示に取り組んでいます。対応する画像にはContent Credentials(C2PA)を付け、画像と音声にはSynthIDの透かしを入れ、openai.com/verifyとContent Provenance APIで誰でも確認できます。メタデータは消されることがあるため、透かしと組み合わせる、という説明です。AnthropicがPNG・JPG・SVGに署名付きのC2PAメタデータを付ける対応も、同じ考え方です。文章はメタデータを持てず、書き換えや翻訳が簡単なため、画像・音声と同じように検出器を公開できていません。

検出の限界

OpenAIは検出の限界を、数字で示しています。誤検出率を1%に合わせた条件では、次のとおりです。

条件検出率
200トークンの文章(心理学の題材)約80%
400トークンの文章(同上)約95%
400トークンで10%を同義語に置換約92%から約66%
400トークンで25%を同義語に置換17%

数学のように言い回しの自由度が小さい内容は、検出率がさらに低くなります。翻訳された文章も検出しにくいと、OpenAIは書いています。

発表には、透かしが「示さないこと」の一覧もあります。

  • 人間がどれだけ関わったかは分からない
  • 文章の所有者や、利用の適法性、責任の所在は分からない
  • 利用者やプロンプトとは結び付かない
  • 内容の正確さは分からない
  • 透かしが見つからなくても、人間が書いた証拠にはならない。短い、編集された、翻訳された、非対応のモデルの出力、他社のAIの出力は、検出できないことがある

企業で使うときに考えたいこと

EUの規制の側では、2026年8月2日に透かしなどの義務が適用になりました。最終版の実施規範は、提供者向けの印付けと検出の規則と、利用者(デプロイヤー)向けの表示の規則からなります。実施規範の署名は任意ですが、AI法第50条の透かしの義務そのものは法的拘束力があります。草案の解説によると、草案は単独の技術では足りないとして、複数の層で印を付ける考え方でした。透かしとメタデータに加え、必要に応じて出力の記録や指紋の照合も挙げています。さらに、AIで書いた公共性のある文章を公開する側にも、そのことの表示を求める内容です。

この発表から、利用する側が見直せる点は次のとおりです。

  • APIで自社の製品を作っているとき: 自社の利用者に対する透明性の義務をどう果たすかを決め、オプトインを使うかを判断する。OpenAIは、透明性の義務にどう組み込むかは顧客が決められるようにする、と説明している
  • 社内で「AIで書いた文章かどうか」を見分けたいとき: 検出器は公開されず、編集や翻訳で検出率が大きく下がる。透かしの有無だけで判定する運用は成り立たない
  • 学生や応募者の文章の審査など、人を評価する場面: 透かしが検出されても、されなくても、それだけで不正とは言えない。OpenAI自身が、透かしでは人間がどれだけ関わったかも、誰の文章かも分からないと説明している

透かしは、文章の出どころを確かめる手がかりのひとつにすぎません。まず確かめたいのは、自社で使っているAPIのモデルが対象に入っているかと、オプトインの設定が初期設定の無効のままになっていないかです。

udon
Microsoft 365、ServiceNow、Copilot などを自ら検証し実務で使える「コシのある知見」を記録しています。