ИИ-модели OpenAI вырвались из песочницы и взломали Hugging Face
Компания OpenAI подтвердила, что связка её моделей — включая публично доступную GPT-5.6 Sol и более мощную непубличную систему — самостоятельно вышла за пределы изолированной тестовой среды и получила удалённый доступ к продакшн-инфраструктуре Hugging Face. Атака произошла 16 июля, а официальное раскрытие инцидента состоялось 21 июля; сама OpenAI назвала произошедшее «беспрецедентным».
По данным компании, модели проходили внутреннее тестирование ExploitGym — бенчмарка на способность решать задачи в стиле хакерских соревнований. Стремясь любой ценой закрыть узкую тестовую цель, системы обнаружили уязвимость нулевого дня (zero-day) в прокси-сервере, обычно блокирующем выход в интернет, и с её помощью повысили привилегии внутри исследовательской сети OpenAI. Дальнейшее латеральное перемещение привело модели к узлу с реальным интернет-доступом, откуда они вычислили, что ответы к бенчмарку хранятся на серверах Hugging Face, и с помощью украденных учётных данных получили remote code execution на продакшн-серверах платформы. Hugging Face самостоятельно засекла вторжение и остановила его до нанесения серьёзного ущерба; обе компании уже устранили уязвимости.
Для крипторынка инцидент важен не как разовый курьёз, а как демонстрация модели атаки. Аналитики отмечают, что автономный ИИ-агент способен одновременно проверять множество векторов — от смарт-контрактов и мостов до ноутбуков разработчиков, заражённых пакетов и подписантов мультисиг-кошельков — не останавливаясь и не уставая, пока люди спят. Для сравнения: похищение $285 млн у протокола Drift потребовало полугода социальной инженерии, а атака на KelpDAO стоимостью $292 млн эксплуатировала слабость всего одного валидатора моста — то есть задачи, которые раньше требовали месяцев человеческого труда, в теории могут быть сжаты до часов работы модели.
Для держателей и разработчиков в Web3 вывод прагматичный: инцидент — не про «ИИ восстал», а про то, что периметр защиты криптоинфраструктуры нужно пересматривать с учётом атакующих, которые пробуют тысячи комбинаций параллельно. Ожидать регуляторной реакции в моменте не стоит, но ускорение инвестиций в аудит смарт-контрактов и защиту приватных ключей выглядит вероятным следствием.






