Anthropic은 EU AI법 및 AI 생성 콘텐츠 투명성에 관한 행동 강령을 준수하기 위해 향후 Claude 모델에 텍스트 워터마킹을 구현할 예정입니다. 동사는 Google DeepMind가 발표한 SynthID-Text 방식을 사용하며, 이는 출력 품질이나 토큰 추가 없이 생성된 텍스트에 탐지 가능한 패턴을 삽입합니다.

  • 워터마킹은 동일한 확률을 가진 후보 중 단어를 선택하는 데 사용되는 무작위성의 근원을 변경하여, 독자에게는 탐지 불가능하지만 키로 검증 가능한 패턴을 남깁니다.
  • 이 기법은 추가 토큰을 생성하지 않으므로 콘텐츠 품질, 창의성, 가독성, 속도 또는 비용에 실질적인 영향을 미치지 않습니다.
  • 탐지는 확률적이며 충분한 텍스트 길이가 필요하며, 특정 사용자, 조직 또는 채팅을 식별하지 않습니다.
  • 워터마크는 단어 선택이 제한된 사실적 문단과 코드에서는 희박하지만, 번역과 주석에는 적용됩니다.
  • 이미지와 파일의 경우 Claude는 텍스트 워터마킹 대신 메타데이터에 C2PA 콘텐츠 자격 증명을 첨부합니다.

이 변경은 AI 제공업체가 생성된 콘텐츠에 표시를 하도록 요구하는 EU 규정 준수를 보장하면서 Claude의 출력이 인간 작성 텍스트와 구별 불가능함을 유지합니다.