Компания Anthropic начала встраивать невидимые водяные знаки во все текстовые ответы своих последних моделей Claude. Изменения вступили в силу для моделей, запущенных в Евросоюзе со 2 августа 2026 года, и со временем будут применены по всему миру, пишет Decrypt.
Нововведение затрагивает все интерфейсы: веб-версию чат-бота, API, инструмент Claude Code, а также облачные интеграции в AWS, Google Cloud и Microsoft. Представители Anthropic пояснили, что маркировка внедряется из-за подписания компанией европейского Свода правил по обеспечению прозрачности в рамках закона об ИИ (EU AI Act).
Защита встраивается непосредственно на уровне модели и становится частью самого генерируемого текста. Из-за этого водяной знак переносится при копировании и может сохраняться даже после частичного редактирования. Точный алгоритм в компании не раскрывают, но независимые исследователи предполагают, что речь идет о статистической сигнатуре — едва заметном изменении частоты выбора определенных слов, аналогичном технологии SynthID от Google.
Решение Anthropic вызвало мгновенную реакцию сообщества разработчиков. На GitHub уже появились первые проекты для обхода защиты, такие как claude-watermark-cleaner и watermarks-remover. Они удаляют невидимые Unicode-символы и переписывают готовый текст с помощью сторонних нейросетей, чтобы нарушить статистический паттерн генерации. Создатели утилит отмечают, что подобные скрытые маркеры не являются надежным способом проверки авторства и лишь вынуждают пользователей тратить ресурсы на повторную обработку текстов.





Пока нет комментариев. Будьте первым!