Anthropic implementará marcas de agua en el texto en futuros modelos de Claude para cumplir con la Ley de IA de la UE y su Código de Práctica sobre la Transparencia del Contenido Generado por IA. La empresa utiliza el método SynthID-Text publicado por Google DeepMind, que incrusta un patrón detectable en el texto generado sin afectar la calidad de salida ni añadir tokens adicionales.

  • La marca de agua altera la fuente de aleatoriedad utilizada para seleccionar palabras entre candidatos igualmente probables, dejando un patrón indetectable para los lectores pero verificable con una clave.
  • La técnica no tiene impacto práctico en la calidad del contenido, la creatividad, la legibilidad, la velocidad o el costo, ya que no produce tokens adicionales.
  • La detección es probabilística y requiere suficiente longitud de texto; no identifica usuarios, organizaciones o chats específicos.
  • Las marcas de agua son escasas en pasajes factuales y código donde las elecciones de palabras están restringidas, pero se aplican a traducciones y comentarios.
  • Para imágenes y archivos, Claude adjunta credenciales de contenido C2PA en los metadatos en lugar de usar marcas de agua en el texto.

Este cambio asegura el cumplimiento de las regulaciones de la UE que requieren que los proveedores de IA marquen el contenido generado, manteniendo al mismo tiempo la indistinguibilidad de las salidas de Claude del texto escrito por humanos.