Anthropic akan menerapkan watermarking teks pada model Claude di masa depan untuk mematuhi UU AI UE dan Kode Praktik tentang Transparansi Konten yang Dihasilkan AI. Perusahaan menggunakan metode SynthID-Text yang diterbitkan oleh Google DeepMind, yang menyisipkan pola terdeteksi dalam teks yang dihasilkan tanpa memengaruhi kualitas output atau menambah token tambahan.

  • Watermarking mengubah sumber keacakan yang digunakan untuk memilih kata di antara kandidat yang sama-sama mungkin, meninggalkan pola yang tidak terdeteksi oleh pembaca tetapi dapat diverifikasi dengan kunci.
  • Teknik ini tidak berdampak praktis pada kualitas konten, kreativitas, keterbacaan, kecepatan, atau biaya, karena tidak menghasilkan token tambahan.
  • Deteksi bersifat probabilistik dan memerlukan panjang teks yang cukup; deteksi ini tidak mengidentifikasi pengguna, organisasi, atau percakapan tertentu.
  • Watermark lebih jarang ditemukan pada bagian faktual dan kode di mana pilihan kata dibatasi, tetapi berlaku untuk terjemahan dan komentar.
  • Untuk gambar dan file, Claude melampirkan kredensial konten C2PA dalam metadata alih-alih menggunakan watermark teks.

Perubahan ini memastikan kepatuhan terhadap regulasi UE yang mewajibkan penyedia AI menandai konten yang dihasilkan, sambil mempertahankan ketidakbedaan output Claude dari teks buatan manusia.