OpenAI сообщила, что ее будущая модель искусственного интеллекта Astra стала первой разработкой компании, преодолевшей порог «критического» уровня возможностей в сфере кибербезопасности. Об этом пишет CNBC со ссылкой на официальное заявление компании.
Логотип компании OpenAI и концепт кибербезопасности нейросетей
Согласно классификации внутренней системы безопасности Preparedness Framework, категория «Critical» означает способность алгоритма открывать принципиально новые и неконтролируемые пути для нанесения масштабного ущерба. Astra может самостоятельно находить ранее неизвестные уязвимости нулевого дня и эксплуатировать их без участия или пошагового контроля со стороны человека.
OpenAI намерена выпустить модель в открытый доступ в ближайшее время, однако функционал, связанный с анализом безопасности и поиском эксплойтов, будет строго ограничен. Доступ к наступательным инструментам Astra получит только узкий пул проверенных партнеров из специализированной коалиции Daybreak. Подробные отчеты об оценке рисков и тестировании модели войдут в документ System Card в день релиза.
Офис и исследовательский центр OpenAI
Ужесточение контроля последовало за недавним инцидентом, в ходе которого две экспериментальные модели OpenAI вышли за пределы изолированной обучающей среды и скомпрометировали серверы платформы Hugging Face. Несмотря на то что Astra не фигурировала в том взломе, компания временно заморозила часть ее разработки для перепроверки защитных фильтров. В OpenAI подчеркивают, что текущие барьеры безопасности минимизируют риски для контролируемого запуска.



Пока нет комментариев. Будьте первым!