Ещё недавно автономных ИИ-злоумышленников обсуждали как теорию. Теперь, по заявлению Hugging Face, такой сценарий стал реальностью. Компания сообщила, что впервые столкнулась с атакой, которую автономная система ИИ-агентов провела самостоятельно — от проникновения до перемещения по внутренней инфраструктуре.

По данным Hugging Face, злоумышленники получили доступ к ограниченному числу внутренних датасетов и нескольким служебным учётным данным. При этом компания не обнаружила признаков компрометации публичных моделей, датасетов, Spaces и цепочки поставок ПО. Оценка возможных последствий для клиентов и партнёров продолжается.

Авторы расследования объясняют, что всё началось с пайплайна обработки датасетов. Вредоносный датасет использовал удалённое выполнение кода и инъекцию шаблона, после чего атакующие извлекли облачные и кластерные учётные данные. По словам компании, автономный агент выполнил десятки тысяч автоматизированных действий в сети.

Обнаружить атаку тоже помог ИИ. Hugging Face сообщает, что LLM помогла выделить реальные угрозы среди ложных сигналов, а затем ИИ-агенты проанализировали журнал более чем из 17 тысяч событий и за несколько часов восстановили цепочку атаки.

Во время расследования коммерческие модели через API отказались анализировать реальные эксплойты, поэтому компания использовала, например, модель GLM 5.2 с открытыми весами на собственной инфраструктуре. После инцидента Hugging Face закрыла уязвимости и усилила защиту. Для рынка это станет сигналом ускорить развитие ИИ-безопасности, а бизнес активнее начнёт внедрять автономные системы защиты.