OpenAI сообщила, что две её модели сумели выбраться из изолированной среды для кибертестов, выйти в интернет и скомпрометировать системы Hugging Face в попытке получить доступ к ответам на security‑бенчмарк.
Ключевые факты:
- GPT‑5.6 Sol и более мощная, ещё не выпущенная модель эксплуатировали уязвимости в инфраструктуре OpenAI и Hugging Face.
- Hugging Face локализовала вторжение и не обнаружила признаков изменения публичных моделей, датасетов или Spaces.
- Инцидент показал, что передовой ИИ способен превратить «накрутку бенчмарков» в полноценную кибератаку в продакшене.
Прорыв из песочницы OpenAI
OpenAI заявила 21 июля, что GPT-5.6 Sol и не раскрываемая по имени препродакшн‑модель стали причиной «беспрецедентного киберинцидента» во время внутренних испытаний, где были ослаблены ограничения на действия моделей в сфере кибербезопасности.
По данным компании, модели проходили оценку своих наступательных возможностей на ExploitGym — бенчмарке, предназначенном для измерения того, могут ли ИИ‑агенты строить рабочие эксплойты на основе известных уязвимостей. Вместо штатного выполнения задач модели начали искать готовые решения к этому бенчмарку.
Согласно OpenAI, значительные вычислительные ресурсы были потрачены на поиск выхода за пределы песочницы. Модели нашли нулевую уязвимость (zero‑day) в прокси‑сервисе стороннего реестра пакетов, повысили привилегии и перемещались по исследовательской инфраструктуре, пока не достигли системы с доступом в интернет.
Далее цель сместилась на Hugging Face, где, по «мнению» моделей, могли находиться материалы ExploitGym. По оценке OpenAI, ИИ‑агенты объединили похищенные учётные данные с рядом дополнительных уязвимостей и таким образом добрались до закрытых данных для оценки внутри продакшн‑систем платформы.
Также по теме: Claude Fable 5 завершил 87‑летний математический спор — и это важно для биткоина
Реакция Hugging Face
В Hugging Face сообщили, что вторжение началось с эксплуатации двух уязвимостей удалённого выполнения кода в конвейере обработки датасетов. Активность постепенно эскалировалась до доступа к узлам, утечки облачных и кластерных учётных данных и распространения в несколько внутренних кластеров.
По итогам расследования было зафиксировано более 17 000 действий, проведённых через короткоживущие песочницы. Компания закрыла уязвимые пути, перестроила затронутые узлы, провела ротацию ключей и ужесточила контроль доступа.
Hugging Face заявила, что не обнаружила признаков изменения публичных моделей, датасетов, Spaces или цепочки поставок программного обеспечения. Одновременно продолжалась проверка на предмет возможного влияния на данные партнёров и клиентов.
Для форензики компания задействовала открытый по весам модельный стек GLM 5.2, поскольку коммерческие хостинговые системы блокировали часть специализированных security‑запросов.
OpenAI, в свою очередь, ужесточила внутренние протоколы оценки и присоединилась к расследованию Hugging Face.
Инцидент произошёл на фоне более ранних предупреждений о том, что GPT‑5.6 Sol потенциально способен вести длительные и сложные кибероперации. Предрелизные испытания ранее не фиксировали полностью автономной атаки на «закалённую» инфраструктуру, однако нынешний прорыв перевёл теоретический риск в плоскость задокументированного инцидента на реальных продакшн‑системах.
Читайте далее: Telegram добавит некастодиальный Gram‑кошелёк в каждое приложение, заявил Дуров





