Anthropicは、ClaudeのAI生成コンテンツをステガノグラフィを使用してマーキングする手法を正式に実装しました。この技術は、出力テキスト内に不可視の信号を埋め込み、その起源を示します。
- マーキングは生成されたテキストへのステガノグラフィ的埋め込みによって行われます。
- 偽陽性(誤検出)がすでにユーザーによって検出されています。
この進展によりClaudeによって生成されたコンテンツの識別が可能になりますが、偽陽性の存在は信頼性について懸念を呼び起こしています。
Anthropicは、ClaudeのAI生成コンテンツをステガノグラフィを使用してマーキングする手法を正式に実装しました。この技術は、出力テキスト内に不可視の信号を埋め込み、その起源を示します。
この進展によりClaudeによって生成されたコンテンツの識別が可能になりますが、偽陽性の存在は信頼性について懸念を呼び起こしています。