Anthropic внедрит водяные знаки в тексте в будущих моделях Claude для соответствия Закону ЕС об ИИ и его Кодексу практики по прозрачности сгенерированного ИИ контента. Компания использует метод SynthID-Text, опубликованный Google DeepMind, который встраивает обнаруживаемый паттерн в сгенерированный текст, не влияя на качество вывода или добавляя лишние токены.

  • Водяной знак изменяет источник случайности, используемый для выбора слов среди равновероятных кандидатов, оставляя паттерн незаметным для читателей, но проверяемым при наличии ключа.
  • Техника не оказывает практического влияния на качество контента, креативность, читаемость, скорость или стоимость, поскольку не генерирует дополнительных токенов.
  • Обнаружение является вероятностным и требует достаточной длины текста; оно не идентифицирует конкретных пользователей, организации или чаты.
  • Водяные знаки редки в фактических отрывках и коде, где выбор слов ограничен, но применяются к переводам и комментариям.
  • Для изображений и файлов Claude прикрепляет содержимое C2PA content credentials в метаданных, а не использует водяные знаки в тексте.

Это изменение обеспечивает соответствие требованиям ЕС, обязывающим поставщиков ИИ маркировать сгенерированный контент, сохраняя при этом неразличимость выводов Claude от текста, написанного человеком.