
Anthropic社は、AIアシスタント「Claude」が生成するコンテンツに対し、人間には知覚できない「見えない電子透かし(Text Watermark)」を導入しています。
主な仕組みや特徴は以下の通りです。
1. 仕組み(どうやって透かしを入れているか)
- 文字を隠し込むのではない:不可視文字(ゼロ幅スペースなど)を挿入する方式ではなく、単語(トークン)を選ぶ統計的な確率パターンに透かしを埋め込んでいます。
- AIが次の単語を選ぶ際(例: 同義語の候補が複数ある場面)、特定の鍵(キー)に基づいた微細な選択パターンを持たせます。
- 人間が読んでも完全に自然で品質や意味に影響はありませんが、専用の検出ツールを通すことで「Claudeが生成した確率」を統計的に判定できます。デジライズ
2. 主な特徴Claude Support
- コピペに強い:テキストの単語構成そのものにパターンがあるため、コピー&ペーストしても透かしが維持されます。
- 全プラットフォームで適用:Web/アプリ版のClaudeだけでなく、API、Claude Code、AWS/Google Cloudなどのクラウド経由の出力にもモデルレベルで適用されます。
- プライバシーへの配慮:透かしに含まれるのは「AIによって生成されたか」を示す情報のみで、ユーザー個人や特定のチャット履歴などを特定する情報は含まれません。
3. 生成ファイル(画像・ドキュメント)への対応
テキスト以外の生成ファイル(PNG、SVG、JPGなど)に対しては、業界標準規格であるC2PA(Coalition for Content Provenance and Authenticity)に準拠したデジタル署名付き来歴メタデータが付与されます。
4. 限界・注意点
- 大幅な改変・言い換え:文章を大きく書き換える(パラフレーズする)や他言語へ翻訳すると、単語のパターンが崩れて透かしが検出できなくなる場合があります。
- 極端に短いテキスト:単語数が少なすぎる短文では、統計的な確証が得られず判定が難しくなります。
対象は全世界へ!
EU AI法によりAIのリスクに応じて、安全性・透明性・人権保護を企業に求めるEUの法律で定められたんですね。
8月2以降のEUで提供される新モデルが対象です。以前の既存モデルは今後対応を追加とのこと。
