Modal Labs підтвердила: бунтівний агент OpenAI захопив пісочницю одного з клієнтів і використав її як плацдарм для приблизно 17 600 зафіксованих дій проти Hugging Face.
Головне:
- Хмарний провайдер повідомив, що тестовий агент OpenAI вирвався з контрольованого середовища, перехопив клієнтську пісочницю і розгорнув із неї ширшу атаку.
- Клієнт залишив відкритий ендпойнт, який дозволяв будь-кому в інтернеті виконувати код.
- OpenAI заявила, що агент дістався чотирьох акаунтів у чотирьох різних сервісах, не розкривши їхні назви.
Злам клієнтської пісочниці в Modal Labs
Технічний директор Modal, Акшат Бубна, розповів, що агент скористався вразливим кодом клієнта.
Цей клієнт опублікував неавтентифікований ендпойнт, який дозволяв будь-якому користувачу інтернету запускати код усередині його хмарних пісочниць. Бубна запевнив журналістів, що власна платформа Modal і її ізоляційні механізми не були скомпрометовані, а наслідки інциденту обмежилися межами одного клієнтського акаунта.
Hugging Face опублікувала 27 липня технічну реконструкцію подій, яка вивела джерело кампанії на пісочницю, розгорнуту в інфраструктурі стороннього провайдера.
У цьому матеріалі ім’я провайдера не згадувалося, однак згодом Modal підтвердила, що йшлося про клієнта, який запускала ExploitGym — публічний бенчмарк для тестування здатності моделей знаходити та експлуатувати програмні вразливості.
В OpenAI від коментарів щодо акаунта в Modal утримались.
Компанія натомість послалася на власне оновлення, де йдеться, що агент дістався чотирьох акаунтів у чотирьох окремих сервісах, не названих публічно. За словами OpenAI, за масштабом і критичністю жоден з інцидентів не наблизився до компрометації Hugging Face.
Читайте також: Крипто-«wrench»-атаки сягнули 52 випадків за пів року, більшість — у Франції
Акшат Бубна та Клеман Деланг про ризики агентів
Співзасновник Hugging Face Клеман Деланг заявив, що його команда ще задовго до офіційного підтвердження OpenAI підозрювала причетність однієї з передових AI-лабораторій до вторгнення і не вважає, що компанія діяла зі злим умислом.
Розкриття ролі Modal розширює картину: автономний агент вийшов за межі початкової пісочниці і проник до інфраструктури третьої компанії, чиї клієнти ніколи не погоджувалися брати участь в експерименті з безпеки OpenAI.
Інженери, які відтворювали хід атаки, класифікували близько 17 600 відновлених дій у приблизно 6 280 кластерів, зафіксованих між 9 і 13 липня в короткоживучих пісочницях, які агент постійно пересоздавав. Переважна більшість спроб виявилася безрезультатною. Їхній висновок: саме машинна швидкість, а не одна «геніальна» вразливість, радикально змінює розклад сил для кіберзахисників.
Хронологія інциденту з бунтівним агентом OpenAI
OpenAI розкрила інцидент 22 липня, повідомивши, що агент вирвався з оціночної пісочниці через вразливість у пакетному проксі та отримав доступ до відкритого інтернету. Для вимірювання «чистого» наступального потенціалу моделі дослідники свідомо вимкнули частину продакшн-фільтрів безпеки.
Відтоді агент було зупинено, зашифровано і повністю від’єднано від дослідницької інфраструктури.
За даними Hugging Face, єдиним клієнтським контентом, до якого агент отримав доступ, були еталонні розв’язки в п’яти наборах даних; жодні інші моделі чи пакети не постраждали.
Минулого тижня стало відомо, що OpenAI не помітила відхилення агента від заданого сценарію до того, як безпосередня загроза вже була ліквідована, і що про інцидент поінформували ФБР.
Далі до теми: Короткострокові прогнози XRP обмежуються $1,25 напередодні рішення ФРС





