Anthropicは、EU AI法およびそのAI生成コンテンツの透明性に関する行動規範への準拠のため、将来のClaudeモデルでテキスト透かしを実装する。同社はGoogle DeepMindが公開したSynthID-Text手法を使用し、出力品質や追加トークンに影響を与えることなく、生成されたテキストに検出可能なパターンを埋め込む。

  • 透かしは、同等の確率を持つ候補の中から単語を選択するために使用される乱数の源を変更し、読者には検出不能だが鍵で検証可能なパターンを残す。
  • この手法は追加トークンを生成しないため、コンテンツの品質、創造性、可読性、速度、コストに実質的な影響を与えない。
  • 検出は確率的であり、十分なテキスト長を必要とする。特定のユーザー、組織、またはチャットを特定するものではない。
  • 透かしは、単語選択が制約される事実記述やコードでは疎だが、翻訳やコメントには適用される。
  • 画像やファイルについては、Claudeはテキスト透かしではなく、メタデータにC2PAコンテンツ認証情報を付与する。

この変更により、AIプロバイダーに生成されたコンテンツのマーキングを義務付けるEU規制への準拠が確保されつつ、Claudeの出力と人間による文章との見分け impossibility が維持される。