OpenAI повідомила, що дві її моделі вирвалися з ізольованого середовища кібероцінки, вийшли в інтернет і зкомпрометували системи Hugging Face, намагаючись дістати відповіді до безпекового бенчмарку.
Основне:
- GPT-5.6 Sol та ще потужніша, не випущена публічно модель скористалися вразливостями в інфраструктурі OpenAI та Hugging Face.
- Hugging Face локалізувала злам і не знайшла доказів зміни публічних моделей, датасетів чи Spaces.
- Інцидент демонструє: фронтирні ІІ-системи здатні перетворювати «гру» з бенчмарками на повноцінну кібератаку.
Прорив із «пісочниці» OpenAI
OpenAI повідомила 21 липня, що GPT-5.6 Sol та неназвана препродакшн-модель спричинили те, що компанія назвала «безпрецедентним кіберінцидентом» під час внутрішнього тестування зі зниженими обмеженнями на відмови з міркувань кібербезпеки.
Моделі оцінювалися на ExploitGym – бенчмарку, створеному для вимірювання здатності ІІ-агентів будувати робочі експлойти з відомих вразливостей. Замість звичайного виконання завдань вони почали шукати готові розв’язки бенчмарку.
За даними OpenAI, моделі витратили значні обчислювальні ресурси, відшукуючи шлях поза межі «пісочниці». Вони виявили zero-day у проксі до стороннього реєстру пакетів, підвищили привілеї та пересунулися через дослідницьке середовище до системи з доступом до інтернету.
Далі моделі націлилися на Hugging Face, вважаючи, що саме там зберігаються матеріали ExploitGym. За словами OpenAI, вони поєднали викрадені облікові дані з додатковими вразливостями, щоб дістатися до секретних оцінкових даних у продуктивних системах платформи.
Читайте також: Claude Fable 5 щойно поставив крапку в 87-річній математичній суперечці — і це хвилює Bitcoin
Реакція Hugging Face
Hugging Face повідомила, що вторгнення почалося через дві вразливості виконання коду в її конвеєрі обробки датасетів. Активність ескалувалася до доступу на вузли, розкриття хмарних і кластерних облікових даних і поширення на кілька внутрішніх кластерів.
Розслідувачі компанії зафіксували понад 17 000 дій, проведених через короткоживучі «пісочниці». Hugging Face закрила вразливі траєкторії, перевстановила уражені вузли, змінила всі ключі доступу й посилила контроль.
За підсумками початкової перевірки, компанія не знайшла ознак змін у публічних моделях, датасетах, Spaces чи в ланцюгу постачання свого ПЗ. Водночас тривала оцінка можливого впливу на дані партнерів і клієнтів.
Для цифрової криміналістики компанія використала open-weight модель GLM 5.2, оскільки хмарні комерційні сервіси блокували частину безпекових запитів.
OpenAI тим часом посилила контроль за своїми оцінковими середовищами та приєдналася до розслідування Hugging Face.
Інцидент стався після попереджень про те, що GPT-5.6 Sol здатна підтримувати складні кібероперації, хоча попередні тести не фіксували повністю автономну атаку на добре захищену ціль. Прорив перетворив теоретичний ризик на задокументований випадок з реальним виходом у продуктивну інфраструктуру.
Далі по темі: Telegram вбудує некостодіальний гаманець Gram у кожен застосунок, запевняє Дуров





