Anthropic mettra en œuvre un filigrane textuel dans les futures versions de Claude pour se conformer au règlement européen sur l'IA et à son code de pratique relatif à la transparence du contenu généré par l'IA. L'entreprise utilise la méthode SynthID-Text publiée par Google DeepMind, qui intègre un motif détectable dans le texte généré sans affecter la qualité de sortie ni ajouter de tokens supplémentaires.

  • Le filigrane modifie la source d'aléa utilisée pour sélectionner les mots parmi des candidats également probables, laissant un motif indétectable par les lecteurs mais vérifiable à l'aide d'une clé.
  • La technique n'a aucun impact pratique sur la qualité du contenu, la créativité, la lisibilité, la vitesse ou le coût, car elle ne produit aucun token supplémentaire.
  • La détection est probabiliste et nécessite une longueur de texte suffisante ; elle n'identifie pas d'utilisateurs, d'organisations ou de conversations spécifiques.
  • Les filigranes sont rares dans les passages factuels et le code où les choix de mots sont contraints, mais s'appliquent aux traductions et aux commentaires.
  • Pour les images et les fichiers, Claude attache des identifiants de contenu C2PA dans les métadonnées plutôt que d'utiliser des filigranes textuels.

Ce changement garantit la conformité avec les réglementations européennes exigeant que les fournisseurs d'IA marquent le contenu généré, tout en maintenant l'indiscernabilité des sorties de Claude par rapport au texte écrit par un humain.