Пока рынок обсуждает, кто быстрее создаст самую мощную ИИ-модель, эксперты всё чаще задают другой вопрос: а кто отвечает за её безопасность? Новый доклад организации SaferAI показывает, что именно здесь разрыв становится всё заметнее.
По данным авторов исследования, китайская открытая модель GLM-5.2 от Z.ai по возможностям в задачах кибербезопасности и биологии отстаёт от OpenAI GPT-5.5 и Anthropic Claude Opus 4.7 всего на несколько месяцев. Однако при проверке через публичный API модель не отказалась ни от одного задания, связанного с наступательной кибербезопасностью или биологией двойного назначения. Для сравнения, Claude Opus 4.7, по данным SaferAI, настолько последовательно блокировала подобные запросы, что пройти тест CyberGym исследователям не удалось.

Авторы объясняют, что после публикации весов модели любые защитные механизмы можно изменить или вовсе удалить. Именно поэтому привычные ограничения, которые используют OpenAI и Anthropic, работают только в облачных сервисах и теряют силу при локальном запуске.
При этом эксперты подчёркивают, что полностью отказаться от открытых моделей тоже нельзя. Они помогают исследователям искать уязвимости и укреплять защиту систем. Но, по мнению авторов доклада, отрасли необходимо научиться делать безопасные возможности доступными всем, одновременно ограничивая наиболее опасные сценарии применения.
Если этот баланс удастся найти, рынок получит более надёжные открытые ИИ-системы без серьёзного ущерба для инноваций. В противном случае развитие моделей может начать опережать механизмы их безопасного использования.
