A Anthropic implementou oficialmente um método para marcar o conteúdo gerado por IA do Claude usando esteganografia. Essa técnica embute sinais invisíveis dentro do texto de saída para indicar sua origem.
- A marcação é feita por meio de inserção esteganográfica no texto gerado.
- Falsos positivos já foram detectados pelos usuários.
Este desenvolvimento permite a identificação do conteúdo produzido pelo Claude, embora a presença de falsos positivos levante preocupações sobre a confiabilidade.