Claudeのテキスト透かし、単語選択の乱数に検出可能な規則
これは何?Claudeのテキスト透かしは、生成文の意味を変えずに単語選択へ統計的な規則を埋め、秘密鍵を持つ検出器がClaudeの関与確率を調べる仕組みです。
Anthropicは、将来のClaudeモデルにGoogle DeepMindのSynthID-Text系の透かしを組み込み、EU AI Act対応としてモデル公開時から世界で適用すると説明しました。文字や識別情報を追加せず、同程度に妥当な次単語の選択に使う乱数を鍵と直前の文脈から決めます。短文、事実記述、コード、軽い校正では検出力が弱く、検出結果は著者や利用者を特定せず、Claudeが一部に関与した可能性だけを示します。
透かし検出は出所確認の補助証拠にはなりますが、短いコードや編集済み文書を断定する判定器にはできません。採用側は誤検出への異議申立てと、C2PAなど別の来歴情報を組み合わせる設計が必要です。
- 読むべき人
- 生成AI基盤、コンテンツ来歴、教育・採用、コンプライアンスの担当者