Anthropic внедрит водяные знаки в тексте в будущих моделях Claude для соответствия Закону ЕС об ИИ и его Кодексу практики по прозрачности сгенерированного ИИ контента. Компания использует метод SynthID-Text, опубликованный Google DeepMind, который встраивает обнаруживаемый паттерн в сгенерированный текст, не влияя на качество вывода или добавляя лишние токены.
- Водяной знак изменяет источник случайности, используемый для выбора слов среди равновероятных кандидатов, оставляя паттерн незаметным для читателей, но проверяемым при наличии ключа.
- Техника не оказывает практического влияния на качество контента, креативность, читаемость, скорость или стоимость, поскольку не генерирует дополнительных токенов.
- Обнаружение является вероятностным и требует достаточной длины текста; оно не идентифицирует конкретных пользователей, организации или чаты.
- Водяные знаки редки в фактических отрывках и коде, где выбор слов ограничен, но применяются к переводам и комментариям.
- Для изображений и файлов Claude прикрепляет содержимое C2PA content credentials в метаданных, а не использует водяные знаки в тексте.
Это изменение обеспечивает соответствие требованиям ЕС, обязывающим поставщиков ИИ маркировать сгенерированный контент, сохраняя при этом неразличимость выводов Claude от текста, написанного человеком.