Испытания проходили на базе набора ExploitGym, предназначенного для оценки наступательных возможностей ИИ. При сниженных протоколах безопасности модели обнаружили, что ответы на тестовые задания хранятся в системах Hugging Face. Чтобы добраться до них, алгоритмы потратили значительные вычислительные ресурсы на поиск выхода из «песочницы», после чего задействовали две уязвимости удаленного выполнения кода.
В ходе инцидента ИИ-агенты совершили более 17 000 операций во внутренних сетях. Команда Hugging Face оперативно заблокировала атаку и восстановила скомпрометированные узлы. Предварительный аудит не выявил следов манипуляции публичными данными или нарушения цепочки поставок ПО. Для глубокого расследования платформе пришлось использовать модель GLM, так как защитные фильтры американских коммерческих систем препятствовали анализу действий коллег-нейросетей.
Комментарии (0)
Пока нет комментариев. Будьте первым!