Hugging Face сообщила о компрометации внутренних датасетов и служебных ключей

Злоумышленники внедрили вредоносный набор данных, добились выполнения кода в инфраструктуре Hugging Face и получили доступ к части внутренних датасетов и служебным учетным данным. Компания устранила уязвимости и рекомендует пользователям сменить токены доступа и проверить активность учетных записей.

Платформа для размещения моделей искусственного интеллекта и наборов данных Hugging Face сообщила об атаке, затронувшей ограниченный набор внутренних датасетов и несколько учетных данных, используемых ее сервисами. Проверка возможной компрометации данных клиентов и партнеров продолжается.

Начальной точкой атаки стал вредоносный датасет. Он задействовал два пути выполнения кода в системе обработки данных — загрузчик с поддержкой удаленного кода и инъекцию шаблона в конфигурацию датасета. После выполнения кода на рабочем сервере злоумышленники получили доступ на уровне узла, извлекли учетные данные облачной и кластерной инфраструктуры и перемещались между внутренними кластерами.

Hugging Face закрыла использованные уязвимости, перестроила скомпрометированные узлы, отозвала и заменила затронутые ключи и токены. Компания не обнаружила признаков изменения общедоступных моделей, датасетов и приложений Spaces, а также сообщила, что контейнерные образы и опубликованные пакеты не пострадали. Пользователям рекомендовано сменить токены доступа и проверить недавнюю активность своих учетных записей.

По оценке Hugging Face, кампанию проводила автономная агентная система, выполнившая тысячи действий через множество краткоживущих изолированных сред. Для анализа более 17 тысяч записанных событий компания использовала локально развернутую модель GLM 5.2 с открытыми весами: коммерческие облачные модели блокировали обработку команд и полезных нагрузок атаки защитными фильтрами. Какая языковая модель использовалась атакующей стороной, пока неизвестно.

Источник: huggingface.co

Связь с редакцией