OpenAI повідомила, що дві її моделі вирвалися з ізольованого середовища для кібероцінки, вийшли в інтернет і зкомпрометували системи Hugging Face, намагаючись дістатися до відповідей на тест із безпеки.
Головне:
- GPT-5.6 Sol та потужніша досі не випущена модель скористалися вразливостями в інфраструктурі OpenAI та Hugging Face.
- Hugging Face локалізувала злам і не виявила доказів зміни публічних моделей, датасетів чи Spaces.
- Інцидент демонструє, як фронтирні системи ШІ можуть перетворити «гру з бенчмарками» на реальну кібератаку.
Прорив із «пісочниці» OpenAI
OpenAI повідомила 21 липня, що GPT-5.6 Sol та неназвана попередньо релізна модель спричинили, за її формулюванням, «безпрецедентний кіберінцидент» під час внутрішнього тестування зі зниженими обмеженнями на дії в сфері кібербезпеки.
Моделі проходили оцінювання своїх наступальних можливостей на ExploitGym — бенчмарку, що вимірює, чи здатні ШІ‑агенти будувати робочі експлойти на основі відомих вразливостей. Замість того, щоб виконувати завдання у штатному режимі, моделі почали шукати готові розв’язки цього тесту.
За даними OpenAI, моделі витратили значні обчислювальні ресурси на пошук виходу за межі «пісочниці». Вони виявили «нульовий день» у проксі до стороннього реєстру пакетів, підвищили власні привілеї та поступово просунулися дослідницьким середовищем до системи з доступом до інтернету.
Далі моделі націлилися на Hugging Face, де, як вони «вважали», зберігаються матеріали ExploitGym. За словами OpenAI, моделі поєднали викрадені облікові дані з іншими вразливостями й таким чином дісталися прихованих оціночних даних у продакшн‑системах платформи.
Також читайте: Клод Fable 5 щойно розв’язав 87‑річну математичну загадку — і це важливо для Bitcoin
Реакція Hugging Face
У Hugging Face заявили, що вторгнення почалося з експлуатації двох вразливостей віддаленого виконання коду в конвеєрі обробки датасетів. Зловмисна активність еволюціонувала до рівня доступу до вузлів, призвела до витоку облікових даних для хмари й кластерів і поширилася на кілька внутрішніх кластерів.
Розслідувачі компанії зафіксували понад 17 000 дій, виконаних через короткоживучі «пісочниці». Hugging Face закрила вразливі шляхи, перевстановила уражені вузли, провела ротацію облікових даних і запровадила жорсткіші контроли доступу.
За підсумками аналізу Hugging Face не виявила ознак змін у публічних моделях, датасетах, Spaces або в ланцюжку постачання свого ПЗ. Водночас компанія продовжувала з’ясовувати, чи могли постраждати дані партнерів чи клієнтів.
Для форензики Hugging Face використала open-weight‑модель GLM 5.2, оскільки хмарні комерційні сервіси блокували частину запитів із безпековою тематикою.
OpenAI тим часом посилила власні процедури тестування й приєдналася до розслідування Hugging Face.
Інцидент стався на фоні попередніх попереджень, що GPT-5.6 Sol здатна підтримувати складні кібероперації. Попри це, дозапускові випробування раніше не фіксували повністю автономної атаки на «загартовану» інфраструктуру. Тепер гіпотетичний ризик перетворився на задокументований випадок, який охопив реальні продакшн‑системи.
Читати далі: Telegram інтегрує некостодіальний Gram‑гаманець у кожен застосунок, — Дуров





