はじめに
Anthropicが2026年8月14日、将来のClaudeモデルへ文章透かしを導入すると発表しました。本稿では、隠し文字を使わず単語選択へ統計的なパターンを残す仕組みと、短文、校正、コードで検出が難しくなる理由を解説します。
参考記事
- タイトル: How Claude’s text watermark works
- 発行元: Anthropic
- 発行日: 2026年8月14日
- URL: https://www.anthropic.com/news/claude-text-watermark
関連記事


要点
- Claudeの文章透かしは隠し文字や識別情報を追加せず、意味が同等な次単語の選択へ統計的なパターンを残す
- AnthropicはGoogle DeepMindが2024年にNatureで発表したSynthID-Text方式を利用する
- 透かしによる追加トークンや追加料金はなく、内部評価では品質や可読性への実用上の影響を確認していない
- 短文、事実記述、軽い校正、コードでは単語選択の余地が少なく、検出の信頼度が下がる
- 透かしはClaudeの関与確率を示すもので、著者、所有権、利用者、組織、会話を特定するものではない
詳細解説
隠し文字ではなく単語選択へパターンを残す
大規模言語モデルは、直前までの文章に続く候補から次のトークンを一つずつ選びます。「寒くて」に続く「曇っていた」と「灰色だった」のように、意味や品質が大きく変わらない候補が複数ある場合、通常は乱数を使って選択します。文章透かしでは、この乱数の生成方法を秘密鍵と直前の数語から決める方式へ変えます。
読者には通常の文章として見えますが、鍵を持つ検出側は、単語の並びが鍵に基づく選択とどの程度一致するかを調べられます。隠し文字、特殊な空白、追加の識別子を文章へ埋め込む方式ではありません。透かしは候補外の不自然な単語を選ばせるものでもなく、意味が同等な選択肢がある場所だけで働きます。
品質、速度、料金への影響
Anthropicは、文章の内容、創造性、読みやすさについて、透かしありとなしの内部評価で影響を確認していないと説明しています。採用するSynthID-Textの論文でも、Geminiの一部トラフィックを使った評価で、利用者の高評価・低評価に統計的な有意差はありませんでした。人による比較評価でも品質差は確認されなかったとされています。
透かしは追加トークンを生成しないため、料金は変わりません。速度への影響も無視できる水準とされています。これは、画面上へ記号を追加する処理ではなく、もともと行われる次トークン選択の乱数源を変えるためです。ただし、品質評価は利用条件や言語によって結果が変わる可能性があるため、公開後の評価も確認する必要があります。
短文、事実、校正、コードでは弱くなる
検出には多くの単語選択が必要です。文章が長いほどパターンを観測できる回数が増え、Claudeが関与した確率を高い信頼度で推定できます。短い文章では観測点が少なく、検出は不安定になります。また、固有名詞や数式の答えなど、正しい語が一つに絞られる箇所では透かしを適用できません。
人が書いた文章を文法と句読点だけ校正した場合、Claudeが選ぶ語は少数です。そのため、変更量によっては検出できません。コードも同様に、識別子や構文を変えると動かなくなる箇所が多く、自然文より透かしが薄くなります。コメントや、同等の命名候補がある場所では働く可能性がありますが、コードの正確性を崩す選択は行わないと説明されています。
検出結果が証明しないもの
検出側が分かるのは、「この文章の一部にClaudeが関与した可能性」です。人が最初から書いたか、Claudeが大幅に編集したかを区別できません。他社AIが書いた文章かどうかも、鍵や方式が異なるため判定できません。完全に書き直せば透かしは弱まりますが、その時点で元の生成文と呼べるかは別の問題になります。
透かしには利用者、組織、チャットの情報が含まれず、個人へ追跡できません。所有権や著作者、法的責任を決める情報でもありません。学校や企業で利用する場合、検出結果だけで不正や規則違反を確定せず、作成履歴や他の証拠と合わせて判断する運用が必要だと考えられます。
EU AI Act対応とファイルのContent Credentials
Anthropicは、EU AI Actと2026年7月に署名した「AI生成コンテンツの透明性に関するCode of Practice」へ対応するため導入するとしています。8月2日以降、EU市場へ提供するAI事業者には生成コンテンツのマーキングが求められ、他の主要事業者も独自の透かしを実装します。地域だけに限定する安定した方法がないため、開始時は世界全体へ適用します。
文章用の検出APIは今後提供予定です。PNG、JPEG、SVGなどの対応ファイルには、文章透かしとは別にC2PA形式のContent Credentialsをメタデータへ付けます。これはファイルの内容を変える隠し透かしではなく、Claudeが作成や処理に関与したことを暗号学的に署名する業界標準です。
まとめ
Claudeの文章透かしは、隠し文字ではなく単語選択の統計的な一貫性から関与確率を推定します。品質や料金への影響を抑える一方、短文や校正、コードでは検出力が下がります。検出結果を著者や不正の証明とせず、来歴確認を補助する情報として扱うことが重要だと思います。
