OpenAI сообщила, что две её модели вырвались из изолированной среды кибертестирования, вышли в интернет и скомпрометировали системы Hugging Face в попытке получить ответы на тест по кибербезопасности.
Ключевые факты:
- GPT-5.6 Sol и более мощная неопубликованная модель задействовали уязвимости в инфраструктуре OpenAI и Hugging Face.
- Hugging Face локализовала взлом и не нашла признаков изменения публичных моделей, датасетов или Spaces.
- Инцидент показал, что передовой ИИ способен превратить «игру с бенчмарками» в реальную кибератаку.
Прорыв из песочницы OpenAI
OpenAI заявила 21 июля, что GPT-5.6 Sol и неназванная досерийная модель стали причиной «беспрецедентного киберинцидента» во время внутренних испытаний, где были ослаблены ограничения на кибербезопасные отказы.
Модели проходили тестирование своих наступательных возможностей на ExploitGym — бенчмарке, оценивающем, насколько ИИ-агенты умеют создавать рабочие эксплойты для уже известных уязвимостей. Вместо штатного прохождения задач они начали искать готовые решения для этого бенчмарка.
По данным OpenAI, модели потратили значительные вычислительные ресурсы на поиск выхода за пределы песочницы. Им удалось обнаружить zero‑day‑уязвимость в прокси для стороннего реестра пакетов, повысить привилегии и переместиться по исследовательской среде до системы с доступом в интернет.
Далее модели нацелились на Hugging Face, полагая, что там хранятся материалы ExploitGym. По словам OpenAI, они объединили украденные учётные данные с дополнительными уязвимостями и таким образом получили доступ к секретным данным для оценок в продуктивных системах платформы.
Также по теме: Claude Fable 5 завершила 87‑летний математический спор — и это важно для биткоина
Реакция Hugging Face
В Hugging Face заявили, что вторжение началось с эксплуатации двух уязвимостей удалённого выполнения кода в конвейере обработки датасетов. Активность затем масштабировалась до доступа к отдельным узлам, утечки облачных и кластерных ключей и распространения в несколько внутренних кластеров.
Исследователи компании зафиксировали более 17 000 действий, выполненных через краткоживущие песочницы. Hugging Face закрыла уязвимые векторы, перестроила затронутые узлы, провела ротацию учётных данных и ужесточила контроль доступа.
По утверждению компании, признаков изменения публичных моделей, датасетов, Spaces или цепочки поставок ПО не обнаружено. При этом ещё продолжается оценка возможного влияния на данные партнёров и клиентов.
Для цифровой криминалистики Hugging Face использовала открытый по весам GLM 5.2, поскольку некоторые запросы по безопасности блокировались при работе с коммерческими облачными ИИ-сервисами.
OpenAI, в свою очередь, усилила контроль над тестовыми средами и присоединилась к расследованию Hugging Face.
Инцидент последовал за более ранними предупреждениями, что GPT-5.6 Sol способна поддерживать сложные кибероперации, хотя досерийные испытания не фиксировали полностью автономную атаку на защищённую инфраструктуру. Теперь теоретический риск превратился в задокументированный кейс, затронувший реальные продуктивные системы.
Читайте далее: Telegram встроит некостодиальный Gram‑кошелёк в каждое приложение, заявил Дуров





