📑 目次
ChatGPTが書いた文章に、目に見えない印が入る。そう聞けば、AIが書いたかどうかを誰でも見抜けるようになると考えたくなる。ところがOpenAIの説明を読むと、印は消せる、見抜く道具は一般に公開されない、印が無くても人間が書いた証拠にはならない、と続く。OpenAIは10月5日、ChatGPTとコーディング用のCodexが出力する文章に、textGrain(テキストグレイン)と呼ぶ透かしをEU域内のユーザー向けに入れると明らかにした。TechCrunchとThe Vergeの報道をもとに、何が入り、何が入らないのかを整理する。
文章の透かしとは何か ChatGPTとCodexに入る印の仕組み
画像の透かしは、画面の隅にロゴを重ねたものを思い浮かべる人が多い。今回の透かしは見た目がまったく違う。TechCrunchによると、記号のような目印は文章に付かない。AIが次の単語を選ぶときの選び方に小さな偏りをつけ、読者の目には見えない規則的なパターンを文章の中に残す。このパターンを探す専用の検出ツールだけが、後から読み取れる。
印は単語の並びそのものに含まれるので、文章をコピーして別の場所に貼り付けても残る。OpenAIはこの手法について、秘密の鍵を使って次に来る単語の候補を並べ替える例を技術報告書で説明している。小さな偏りを数百か所分積み重ねると、検出ツールは文章と鍵だけでAIが書いたものかどうかを判定できるという。技術報告書はペンシルベニア大学とイェール大学の研究者との共著である。
OpenAIは、使った人が誰かは透かしから分からないと説明している。モデルの性能にも意味のある変化は出なかったという。The Vergeによれば、ベンチマーク(AIの能力を測る共通の試験)の点数も、透かしあり・なしの文章で同程度だった。textGrainはGoogle DeepMindのSynthIDなど他の方式と「同等かそれ以上」とOpenAIは述べている。
EU限定で始まる理由 AI法の透明性ルールが背景
導入の動機は法律への対応である。TechCrunchによると、EUのAI法の透明性ルールは8月2日に施行され、AI企業にはAIが生成したコンテンツを、ほかのシステムが識別できる形で示す義務がある。この義務の内容と制裁の重さについては、EUのAI表示義務が8月2日に発効し、違反には売上の3%の制裁が科されるという解説で詳しく扱った。
ChatGPTとCodexでは、EUの対象ユーザーに、すべてのプランで今後数週間かけて順次導入する。EU以外では、発表時点で世界共通の既定にはしない。OpenAIは、地域を絞ると実際の利用と反応から学ぶ余地ができると説明している。
一方、開発者向けのAPI(自社のサービスにAIの機能を組み込むための接続口)は扱いが違う。世界中のAPI利用者が、一部のモデルについて透かし入りの出力を選べるようになった。10月5日から使えるが、初期設定ではオフである。入れるかどうかは各社が、自社の透明性の義務や利用者への見せ方に合わせて決める。
textGrainの検出率 10%の単語を言い換えると92%が66%に
最も引っかかるのは、透かしの強さである。TechCrunchによると、OpenAIの試験で、文章の単語の10%を類義語に置き換えると、透かしを検出できる割合が約92%から約66%に下がった。ここでいう検出率は、透かし入りの文章に対して、検出ツールが「OpenAIの透かしがある」と正しく判定できた割合を指す。条件をそろえて書けば、10%の単語を言い換えた場合に、約92%が約66%になるということだ。
10個に1個の単語の言い換えなら、人が手作業でも難しくない。OpenAI自身が、短い文章、数学の答え、翻訳した文章では、さらに検出しにくいと認めている。透かしは入っても、あとから手を加えられれば弱くなる。
この弱さについて、OpenAIは検出ツールの公開を見送る理由の一つに挙げている。同社は、見落としと誤検出(AIが書いていない文章をAI製と誤判定すること)の危険があるとして、公開開始時点では一般に出さないと述べている。
検出ツールは非公開 使えるのは承認された研究者だけ
検出ツールを使えるのは、承認された研究者と専門組織に限られる。申請は10月5日から受け付けており、OpenAIが「行動規範」(EUのAI法に沿うための指針)に従って、当面は個別に審査して許可する。ツールは、OpenAIの透かしを検出したかどうかだけを返し、文章を書いた利用者の特定や、利用者の指示内容、会話の中身の開示はしない。
したがって、取引先から届いた文章に透かしがあるかを、一般の企業や個人が自分で調べる手段は、公開時点では無い。
透かしが無くても人間が書いた証拠にはならない
もう一つ重要なのは、透かしの有無から言える範囲である。OpenAIは、透かしが見つからないことは「人間が書いた証拠にならない」と注意している。TechCrunchによると、その理由として、文章が短すぎる場合、大きく編集されている場合、ほかの会社のAIが書いた場合を挙げている。
透かしが見つかった場合でも、分かることは限られる。The Vergeによれば、OpenAIは透かしが内容の正確さを保証せず、文章の所有者を決めず、人間の関与の度合いを測らず、人間が書いた証明にもならないと説明している。TechCrunchが引用した発言でも、透かしはOpenAIのシステムが文章の一部を生成または処理したことを示せても、人間の判断や編集がどれだけ入ったかは示せないという。
OpenAIはtextGrainが「確実な検出を保証しない」とも明記している。透かしは、AIが関わった可能性を示す手がかりの一つにとどまる。
Anthropicは8月に世界で導入 一部ユーザーが反発
OpenAIの前に、Anthropicが動いていた。TechCrunchによると、AnthropicはClaudeが生成する文章に透かしを入れると8月に明らかにし、こちらは世界中に適用する。The Vergeによれば、これはGoogle DeepMindのSynthIDを土台にした方式で、OpenAIと同じくEUのAI法の要件を満たすための措置である。
反応は一様ではなかった。TechCrunchは、一部のClaudeユーザーが反発したと伝えている。ユーザーの主張は、自分たちが「指示、文脈、判断」を与えており、Claudeは「道具」にすぎない、というものだった。文章の中身を決めたのは自分なのに、AI製の印が付くのは納得できないという意見である。
この反発は、OpenAIが挙げた限界と重なる。透かしは、人間がどれだけ関わったかを測れない。両社は同じ法律に応えつつ、適用する地域の範囲を違う形で選んだ。使う側は、どのサービスのどの出力に印が入るのかを、サービスごとに確かめる必要がある。
画像との違いと企業が確認すべきこと
AIの出力に印を付ける動きは、文章だけの話ではない。画像・動画では、Googleが画像・動画のAI透かしの解除を許可した話という動きもあった。
文章の場合、単語を少し言い換えるだけで検出率が下がる。EUで事業を持つ企業は、自社が出す文章にAI生成の印が入る可能性と、APIで自社サービスに組み込む場合に透かしを入れるかどうかを、あらかじめ決めておきたい。取引先や従業員の文章に印が無いことを、人間が書いた証拠として扱えない点も押さえておく。
まとめ
OpenAIのtextGrainは、EUのChatGPTとCodexの文章に印を入れるが、10%の単語の言い換えで検出率が約92%から約66%に落ち、検出ツールも一般には公開されない。印が無いことは人間が書いた証拠にならず、印があっても人の関与の度合いは分からない。透かしは判定の決め手ではなく、手がかりの一つとして扱うのが現実的だ。
参考・出典
- TechCrunch「OpenAI will start watermarking ChatGPT’s text in the EU」
- The Verge「OpenAI is adding text watermarking in ChatGPT and Codex」
- OpenAI公式ブログ(TechCrunch・The Vergeが引用した範囲で参照)
📚 関連書籍を Amazon で探す
広告: Amazon アソシエイトプログラムによるリンクです
- 📚 AIガバナンス・倫理・法務 →
EU AI Act、PL法、リスクマネジメント関連。
- 📚 AI法務の実務 →
AI 時代の契約・知財・プライバシー。













