A Anthropic implementou oficialmente um método para marcar o conteúdo gerado por IA do Claude usando esteganografia. Essa técnica embute sinais invisíveis dentro do texto de saída para indicar sua origem.

  • A marcação é feita por meio de inserção esteganográfica no texto gerado.
  • Falsos positivos já foram detectados pelos usuários.

Este desenvolvimento permite a identificação do conteúdo produzido pelo Claude, embora a presença de falsos positivos levante preocupações sobre a confiabilidade.