Американский стартап Anthropic раскрыл технические детали технологии скрытой маркировки текста, генерируемого нейросетью Claude. Решение внедряется для соответствия требованиям европейского закона об искусственном интеллекте (EU AI Act), об этом пишет The Verge.
Разработчики используют модифицированную версию открытой системы SynthID-Text, созданной подразделением Google DeepMind. Этот метод основан на корректировке статистических вероятностей при выборе слов во время генерации текста.
Иллюстрация процесса нанесения скрытых водяных знаков на сгенерированный искусственным интеллектом контент
В Anthropic объясняют принцип работы технологии на простом примере. При построении предложения «Погода сегодня была холодной и...» система выбирает следующее слово из списка наиболее вероятных совпадений (например, «пасмурной» или «серой»). Для читателя разница в смысле минимальна. В обычной ситуации модель делает выбор случайным образом, но при маркировке стандартный генератор случайных чисел заменяется алгоритмом, который учитывает специальный ключ и несколько предыдущих слов.
В результате в тексте формируется определенный статистический паттерн. Он остается полностью невидимым для человека, но легко считывается специальным ПО, у которого есть доступ к ключу декодирования.
В компании подчеркнули, что внедрение водяных знаков не повлияет на стоимость использования Claude или на общее качество генерации ответов. Помимо маркировки текста, Anthropic также добавляет поддержку стандарта метаданных C2PA для обрабатываемых нейросетью изображений.
Аналогичные требования регуляторов ЕС распространяются и на других технологических гигантов. Google применяет технологию SynthID в чат-боте Gemini с 2024 года. Ожидается, что OpenAI также представит собственное решение для маркировки текстов в ChatGPT в рамках дорожной карты по соблюдению европейского законодательства.






Пока нет комментариев. Будьте первым!