Разработчик искусственного интеллекта Anthropic объявил о скором внедрении машиночитаемых водяных знаков во все материалы, которые обрабатывают его модели. Об этом пишет Ars Technica со ссылкой на справочные материалы компании.
Решение принято для соблюдения европейского Закона об ИИ (EU AI Act). Согласно документу, разработчики обязаны маркировать созданные или измененные нейросетями аудио, изображения, тексты и видео. Правило распространяется на все модели, выпущенные после 2 августа, а для более ранних версий предусмотрен переходный период до декабря 2026 года.
Маркировка будет глобальной и затронет все новые модели компании. В текстовых ответах водяные знаки будут скрытыми, а файлы других форматов получат цифровые метаданные об источнике по стандарту C2PA.
Особенность подхода Anthropic заключается в том, что водяной знак будет накладываться на любой обработанный контент. Закон ЕС не требует маркировки при базовом редактировании текста (например, исправлении опечаток), однако алгоритмы на уровне модели не способны отличить полную генерацию от точечной редактуры. В результате Claude будет маркировать даже те тексты, которые пользователь написал сам и лишь пропустил через ИИ для проверки орфографии.
Технология текстовых знаков работает за счет микроизменений в выборе слов при генерации, что формирует скрытый паттерн. В Ars Technica отмечают, что это может приводить к использованию менее точных формулировок ради сохранения структуры водяного знака. При этом защиту легко обойти: разметка может стереться при копировании текста в другую языковую модель или при ручном редактировании.
Anthropic планирует опубликовать инструменты для обнаружения скрытых знаков. В компании признают, что наличие метки не дает стопроцентной гарантии генерации — она лишь указывает на то, что контент «мог быть обработан» Claude.





Пока нет комментариев. Будьте первым!