Компания Anthropic опубликовала разъяснения о работе системы водяных знаков в ответах чат-бота Claude, сообщает TechCrunch. Разработчики пошли на этот шаг после критики со стороны пользователей: некоторые подписчики начали отменять платные подписки, опасаясь ухудшения качества генерации или раскрытия личных данных.
Внедрение водяных знаков связано с необходимостью соблюдения Закона об ИИ Европейского союза (EU AI Act), который требует от создателей нейросетей обеспечивать маркировку сгенерированного контента. По заявлению Anthropic, технология работает на базе метода SynthID-Text, разработанного командой Google DeepMind. Маркировка основывается на изменении математической вероятности выбора слов в ситуациях, когда у модели есть несколько равнозначных вариантов (например, при выборе между синонимами «пасмурно» и «серо»).
Для обычного читателя водяной знак остается абсолютно незаметным и никак не влияет на общее качество текста. Распознать разметку можно будет с помощью специального API, который Anthropic планирует выпустить позже. В отличие от стандартных детекторов ИИ, оценивающих стилистику письма, этот метод использует точный криптографический ключ.
Разработчики подчеркивают, что легкая ручная редактура текста не сотрет водяной знак полностью. Избавиться от него можно только путем глубокого рерайта, при котором заменяется каждое слово. Если же Claude используется только для вычитки или исправления ошибок в готовом пользовательском материале, водяной знак практически не наносится.
В генерируемом программном коде водяные знаки будут присутствовать минимально, поскольку написание рабочего кода требует строгой логики без вариативности. Разметка сможет затрагивать только необязательные элементы, вроде комментариев к коду. Anthropic также отметила, что другие крупные ИИ-лаборатории, подписавшие кодекс ЕС, вскоре внедрят аналогичные решения в свои продукты.





Пока нет комментариев. Будьте первым!