Компания Anthropic объявила о внедрении системы маркировки для текстов и файлов, созданных с помощью семейства моделей Claude. Как сообщает CNET, это решение позволит разработчикам соответствовать правилам Европейского союза по прозрачности искусственного интеллекта.
Маркировка будет применяться на уровне моделей, запущенных после 2 августа. Это означает, что водяные знаки появятся в контенте из любых интерфейсов, включая веб-версию Claude, API, Claude Code, Claude Cowork и Claude Tag. Изменения затронут пользователей по всему миру, а не только в странах ЕС.
Для текстовых ответов Anthropic использует невидимые сигналы — особые последовательности слов и интервалы между символами. Такие маркеры невозможно заметить при чтении, но их легко распознают алгоритмы. Водяные знаки сохранятся, даже если скопировать текст в простые редакторы вроде «Блокнота» на Windows или TextEdit на macOS. Обычное редактирование человеком также вряд ли поможет полностью избавиться от этих меток.
Файлы изображений в форматах SVG, PNG и JPG получат криптографическую подпись с метаданными о происхождении. Любая попытка изменить файл с целью скрыть ИИ-след нарушит целостность подписи, что укажет системам мониторинга на факт редактирования.
В Anthropic подчеркивают, что технология не гарантирует абсолютной точности. Например, если пользователь попросит Claude отредактировать написанный человеком текст, результат получит водяной знак, хотя исходная фактология принадлежит человеку. Представители компании пообещали опубликовать технические детали о методах обнаружения маркировки позднее.





Пока нет комментариев. Будьте первым!