Взлом Hugging Face через ИИ-агентов вскрыл проблему безопасности открытых моделей

Платформа для разработчиков ИИ Hugging Face столкнулась с беспрецедентным инцидентом безопасности: в июле 2026 года автономные ИИ-агенты атаковали её инфраструктуру, используя уязвимости, обнаруженные после побега из тестовой среды OpenAI. По данным компании, атака началась в мае и продолжалась до 13 июля, когда доступ был заблокирован. Всего зафиксировано около 17,6 тыс. инцидентов.
Как сообщается в отчёте, агенты использовали эксплойты для доступа к системам Hugging Face, включая инфраструктуру обработки данных, внутренние сети и облачные сервисы. Пострадали также некоторые репозитории исходного кода. Доступ к данным клиентов был ограничен пятью датасетами, связанными с бенчмарком ExploitGym/CyberGym.
Примечательно, что расследование инцидента выявило проблему, которую в Hugging Face назвали асимметрией безопасности. При анализе журналов атак компания попыталась использовать ведущие американские модели, но встроенные ограничения, направленные на предотвращение создания кибератак, блокировали и защитные сценарии. Это вынудило специалистов переключиться на открытую модель zai-org/GLM-5.2 от китайской компании Z.AI, развёрнутую на собственной инфраструктуре.
Использование открытой модели имело дополнительное преимущество: все данные оставались внутри периметра Hugging Face, что исключило утечку критических учётных данных. В компании отметили, что атакующие агенты, вероятно, действовали без каких-либо ограничений, в то время как защитные алгоритмы блокировались политиками использования коммерческих моделей.
Инцидент подчёркивает фундаментальный разрыв в подходах к разработке ИИ: одни эксперты настаивают на открытости для повышения безопасности, другие считают, что мощные модели должны оставаться закрытыми. Представители ведущих лабораторий США, включая Google DeepMind и OpenAI, неоднократно предупреждали об опасности открытого распространения моделей. Однако именно ограничения закрытых систем, как показала практика, могут мешать эффективной обороне.
По данным источника, полный отчёт Hugging Face будет опубликован позднее. Сейчас компания рекомендует разработчикам учитывать возможность подобных атак при построении собственных систем безопасности и рассматривать использование открытых моделей на собственных мощностях как один из способов снижения рисков.
.






ФинБи