Anthropic объявила о внедрении системы невидимых водяных знаков для маркировки текстов, генерируемых нейросетью Claude. Решение принято в рамках соблюдения статьи 50 европейского закона об искусственном интеллекте (EU AI Act), передает India Today со ссылкой на официальный блог компании.
Технология работает на этапе генерации контента. Когда у модели есть несколько синонимов для продолжения фразы, система использует секретный ключ для выбора конкретных слов, создавая скрытый статистический паттерн. Обычный читатель не заметит изменений, но специальный алгоритм детекции сможет с высокой точностью определить участие Claude в написании материала.
В Anthropic подчеркивают, что маркировка не ухудшает читаемость, смысл или скорость выдачи ответов. Водяной знак не содержит персональных данных пользователей, информации об организациях или конкретных диалогах — он привязан исключительно к самой структуре текста.
При этом у технологии есть ограничения. Маркировка не может гарантировать авторство ИИ, если пользователь попросил Claude лишь отредактировать, перевести или проверить уже готовый текст. Также водяные знаки практически неэффективны в программном коде из-за строгой синтаксической структуры, хотя могут оставаться в комментариях к нему.
Глубокий рерайт или ручная замена слов также могут полностью уничтожить скрытый паттерн. В компании добавили, что функция будет активирована для всех пользователей по всему миру, так как на данный момент у разработчиков нет надежного технического способа ограничить ее применение только территорией Евросоюза.





Пока нет комментариев. Будьте первым!