Anthropic 将在未来的 Claude 模型中实施文本水印,以符合欧盟《人工智能法案》及其关于 AI 生成内容透明度的行为准则。该公司采用 Google DeepMind 发布的 SynthID-Text 方法,该方法在不影响输出质量或增加额外 token 的情况下,在生成的文本中嵌入可检测的模式。
- 水印通过改变用于在同等可能候选词中选择词语的随机性来源,留下对读者不可见但可通过密钥验证的模式。
- 该技术对内容质量、创造力、可读性、速度或成本没有实际影响,因为它不产生额外的 token。
- 检测是概率性的,需要足够的文本长度;它不识别特定用户、组织或聊天会话。
- 在事实段落和代码中,由于词语选择受限,水印较为稀疏,但适用于翻译和注释。
- 对于图像和文件,Claude 在元数据中附加 C2PA 内容凭证,而不是使用文本水印。
这一变更确保符合欧盟要求 AI 提供商标记生成内容的法规,同时保持 Claude 输出与人类撰写文本的不可区分性。