印から分かるのは一つだけ
OpenAIは、透かしで分かることと分からないことを明確に示しています。印から分かるのは、OpenAIのシステムが文章の一部を生成または処理したということだけです。誰がそのシステムを使ったか、人間がどれだけ手を加えたか、文章が誰のものか、内容が正しいかは分かりません[1]。Anthropicも、透かしには個々の利用者に関する情報は含まれないとしています[2]。
| 知りたいこと | 透かしから分かること |
|---|---|
| AIシステムが文章の一部を生成または処理したか | 印が検出されれば、そうだと分かる |
| 誰がそのシステムを使ったか | 分からない |
| 人間がどれだけ手を加えたか | 分からない |
| 文章が誰のものか | 分からない |
| 内容が正しいか | 分からない |
| 印が検出されなければ、人間が書いた文章か | 人間が書いた証拠にはならない |
今、どの文章に印が付くのか
OpenAIは2026年10月5日、今後数週間かけて、EUで生成されるChatGPTとCodexの文章のうち、対象となるものに目に見えない透かしを入れると発表しました。同日から、世界中のAPI利用者も一部のモデルでこの機能を自分で有効にできます。ただし、APIでは初期設定が無効になっており、提供開始と同時に世界中で標準適用されるわけでもありません[1]。
これに先立つ8月14日、Anthropicは今後登場するClaudeモデルが生成する文章に透かしを入れると発表しました。地域を分けて適用する確実な方法がないため、最初から世界中で適用します[2]。韓国でClaudeを使って業務文書の下書きを作る人も、新しいモデルから対象になるということです。
OpenAIが使う方式はtextGrainです。単語の選び方に統計的な信号を加え、人の目には見えなくても、検出器が統計的に識別できるパターンを残します[1]。Anthropicの方式は、Google DeepMindが2024年に学術誌Natureで発表したSynthID-Textを基にしています[2]。
検出結果だけでは修正の量は測れない
AI Mattersが報じた数値を見ると、透かしの検出率は文章の長さや修正の程度によって変わります。偽陽性率を1%に設定した場合、400トークンの文章は約95%、200トークンの文章は約80%が検出されました。400トークンの文章で単語の10%を同義語に置き換えると、検出率は約92%から66%に下がり、25%を置き換えると17%まで低下しました。数学に関する文章の検出率は、はるかに低いものでした[3][4]。
Anthropicの説明も同じ方向を示しています。軽く手を入れる程度では印は完全には消えませんが、すべての単語を変えて書き直せば消えるとしています[2]。
したがって、検出結果の高低を自分の貢献度と捉えることはできません。一部の単語を同義語に置き換えるだけでも検出率は下がりますが、それで自分の判断が文章により多く反映されたことにはなりません。OpenAIも、印だけでは人間がどれだけ手を加えたかは分からないと明示しています[1]。
検出器を誰でも使えるわけでもありません。OpenAIは当初、承認を受けた研究者と専門機関に限って検出器を公開します[1]。Anthropicの検出APIは非公開プレビューの段階です。対象は、EU法で定められた機関など(規制当局、捜査機関、報道機関、ファクトチェッカー、独立研究者、教育機関、EUの市民団体)と、法令順守のために確認する義務のある企業です[2]。現時点では、チームリーダーや社内の確認担当者が文書を入れて、すぐに判定を受けられる段階ではありません。
自分の作業は原稿の履歴とメモに残す
AIの下書きを基に文書を書いた人が、自分の貢献を示すには、印とは別の記録が必要です。修正の過程が分かる原稿の履歴、参考にした資料の一覧、どの段階で道具を使ったかを記したメモが、その役割を果たします。
メモに入れる項目は、書籍の原稿と大きく変わりません。ガイド「原稿にAIを使ったら、出版社に何を伝えるべきか」で提案した4つの欄(道具、活用した段階、活用した範囲、人間が検証した内容)は、業務文書にもそのまま使えます。出版社ではなくチームリーダーや顧客から聞かれたときも、同じ記録で答えればよいのです。
業務文書では、次の3つを押さえればよいでしょう。
- AIから受け取った下書きは、そのまま別に保存します。最初の状態がなければ、何を直したか比較できません。
- 大きく修正するたびに、別のバージョンとして残します。構成を変えた版、数値を確認した版など、何をしたかが名前で分かるようにします。
- 参考にした資料と道具を使った段階は、文書の末尾か別のメモに記します。
表示義務を負うのは誰か
EU AI法第50条に定められた透明性に関する義務は、2026年8月2日から適用されました。AIで文章を生成するシステムの提供者は、出力に機械が読み取れる印を付け、検出できるようにする必要があります。通常の編集を支援する補助機能や、入力を大きく変更しない場合は例外です。8月2日より前に市場に投入された生成AIシステムには、2026年12月まで猶予が与えられます[5]。
文章を発行する側にも義務があります。人間による確認や編集責任を経ていないAI生成の文章を、公共の関心事について知らせる目的で発行する場合、利用者が認識できる表示を付ける必要があります。一方、人間が確認し、責任を負う文章は、この表示義務の対象外となります[5]。
確認や編集を担当したという事実も、印からは分かりません。その記録も、人間が残す必要があります。
韓国では、AI基本法が2026年1月22日に施行されました。ディープフェイクではないAI生成物には、目に見える表示の代わりに、目に見えない透かしを使うこともできます。政府は施行日から少なくとも1年間の指導期間を設け、その間は事実調査と過料の賦課を見送ることにしました[6]。
参考資料
- [1] OpenAI開発者コミュニティ、OpenAI's approach to EU text provenance rules、2026年10月5日。
- [2] Anthropic、How Claude's text watermarking works、2026年8月14日。
- [3] AI Matters、2026年10月6日報道。
- [4] TechCrunch、2026年10月5日報道。
- [5] 欧州委員会、Quick Facts: Transparency rules for AI systems。
- [6] 科学技術情報通信部、AI基本法に関する報道発表資料。
よくある質問
透かしが検出されなければ、自分が書いた証拠になりますか?
いいえ。OpenAIは、透かしが検出されなかったからといって、人間が書いた証拠にはならないと明示しています。他社のモデルを使った可能性も、書き直すうちに信号が弱まった可能性もあります。自分が書いたことを示す根拠は、バージョンごとの原稿やメモに残す必要があります。
透かしに自分の名前やアカウント情報は含まれますか?
Anthropicは、透かしには利用者を特定できる情報は含まれないとしています。OpenAIも、印だけでは誰がそのシステムを使ったかは分からないと説明しています。印から分かるのは、AIシステムが文章の一部を生成または処理したかどうかまでです。