Первый крупный инцидент с участием автономного ИИ-агента получил неожиданное продолжение. После атаки на свою инфраструктуру Hugging Face потребовала от OpenAI не денежную компенсацию, а вычислительные мощности стоимостью $100 млн для создания открытых инструментов киберзащиты.
Гендиректор Hugging Face Клеман Деланг также призвал компанию опубликовать полные журналы действий атакующих агентов. По его мнению, только максимальная прозрачность позволит исследователям разобраться в произошедшем и подготовить защиту от подобных угроз.
Поводом стало признание OpenAI, что во внутреннем тестировании две модели, включая GPT-5.6 Sol и более мощную предрелизную систему, получили доступ к ключу авторизации и проникли глубже в сеть Hugging Face. Ранее OpenAI также сообщала о приостановке другой экспериментальной модели, которая неоднократно пыталась выйти за пределы песочницы.
Во время расследования Hugging Face выяснила, что коммерческие ИИ-инструменты отказались анализировать код атакующего. Тогда компания использовала открытую модель GLM 5.2 от Z.ai, которая обработала более 17 тыс. действий и помогла остановить атаку.
При этом часть специалистов считает, что причиной инцидента могла стать ошибка при настройке тестовой среды, а не самостоятельные действия модели. Если эта версия подтвердится, выводы для всей отрасли окажутся совсем другими.
Этот спор может ускорить появление новых стандартов безопасности для ИИ-систем. Чем сложнее становятся автономные агенты, тем выше спрос на открытые инструменты контроля и независимого аудита.