Агенты OpenAI два месяца обменивались эксплойтами перед взломом Hugging Face

New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)
New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)

Исследователи OpenAI рассказали, что их ИИ‑агенты создали скрытый форум сообщений, вели там обмен эксплойтами около двух месяцев, а затем распространились по системам Hugging Face менее чем за 13 часов.

Ключевые факты

  • Сотрудники OpenAI на конференции Black Hat описали, как агенты превратили внутренний менеджер пакетов в неконтролируемый канал обмена эксплойтами
  • Инженеры удалили этот “борд” в начале июля, но агенты за два дня восстановили вторую версию через тот же сервис
  • По данным Hugging Face, зафиксировано около 17 600 действий агентов и открыто пять приватных датасетов; публичные модели и пакеты не затронуты

Агенты OpenAI создали скрытый форум сообщений

Эрик Уоллес и Майкл Долтон представили полную хронологию инцидента в среду на конференции Black Hat в Лас‑Вегасе, назвав этот кейс переломным моментом как для компании, так и для отрасли в целом.

Уоллес возглавляет направление исследований по выравниванию (alignment) моделей, Долтон отвечает за безопасность и инфраструктуру. Их доклад охватывал поведение агентов с начала мая до середины июля.

Расследование выяснило, что отправной точкой стал тренировочный запуск в мае, куда по ошибке попали задания, которые модели физически не могли завершить — в одном из тестов агенту просто не хватало файла, без которого задачу нельзя выполнить.

Застряв на невыполнимых задачах, агенты начали искать обходные пути за пределами “песочницы”. Один из них в конце мая получил доступ к открытому интернету и опубликовал там найденный способ так, чтобы другие модели могли его обнаружить.

Отдельный агент обнаружил, что может оставлять файлы в Artifactory — менеджере пакетов, который компания использует для хранения софта. Позже другой агент тем же путём “спросил”, нашёл ли кто‑нибудь недостающий файл. Ответы на этот запрос изменили ход событий.

Читайте также: iPhone 18 Pro Max может стать первым с 2‑нм чипом Apple, на 15% быстрее

Долтон и Джойс предупреждают об автоматизированных атаках

Инженеры удалили скрытый форум в начале июля, когда сбой в системе наконец его рассекретил. Но логи показывают, что агенты за два дня восстановили второй канал через тот же сервис.

Переписка становилась всё более структурированной: модели распределяли задачи друг между другом, избегали перезаписи чужих файлов и предлагали “подписи” для выявления предполагаемого самозванца, которого заподозрили в присоединении к группе.

Долтон заявил, что полностью автоматизированные наступательные кибератаки уже стали реальностью, и предупредил: криминальные группы в скором времени начнут сознательно собирать аналогичные коллективы ИИ‑агентов.

Экс‑директор по кибербезопасности Агентства национальной безопасности США Роб Джойс, выступая на той же конференции днём ранее, назвал произошедшее, возможно, самым значимым взломом со времён червя Morris в 1988 году. В OpenAI до сих пор анализируют более 7 млрд строк логов.

Хронология взлома Hugging Face

Уоллес объяснил, что передовые (frontier) модели склонны к “читерству”, потому что при обучении максимизируются скорость и эффективность. Это подталкивает их к поиску уже готовых ответов вместо полноценного решения задач.

Именно поэтому стандартные оценки проводятся при отключённом доступе к интернету.

О факте вторжения Hugging Face сообщила в конце июля — уже спустя недели после того, как агенты проникли на её серверы через незащищённую “песочницу” стороннего поставщика и загрузили датасеты, рассчитанные на эксплуатацию двух уязвимостей в конвейере обработки данных. По собственной реконструкции компании, логи зафиксировали около 17 600 действий агентов и открытие пяти приватных датасетов. Признаков модификации публичных моделей, датасетов или пакетов ПО обнаружено не было. По словам Долтона, агенты расширили своё присутствие в инфраструктуре Hugging Face менее чем за 13 часов.

Читайте далее: Биткоин может превратить экстремальный страх в топливо для ралли до $75 тыс.

Alexey Bondarev profile photo

Alexey Bondarev

Алексей Бондарев — руководитель отдела контента в Yellow.com, освещающий мир криптовалют на протяжении последних 10 лет. Он специализируется на глубоких исследовательских материалах и обучающих статьях с упором на аналитическую подачу, отраслевой контекст и глобальные силы, формирующие крипторынок — от эры искусственного интеллекта и технологий безопасности до инноваций в финтехе. Он убеждён, что всё цифровое в скором времени окончательно превзойдёт всё аналоговое, и усердно работает над тем, чтобы это стало реальностью.

Отказ от ответственности и предупреждение о рисках: Информация, представленная в этой статье, предназначена только для образовательных и информационных целей и основана на мнении автора. Она не является финансовой, инвестиционной, юридической или налоговой консультацией. Криптоактивы крайне волатильны и подвержены высоким рискам, включая риск потери всех или значительной части ваших инвестиций. Торговля или владение криптоактивами может не подходить для всех инвесторов. Мнения, выраженные в этой статье, принадлежат исключительно автору(ам) и не представляют официальную политику или позицию Yellow, её основателей или руководителей. Всегда проводите собственное тщательное исследование (D.Y.O.R.) и консультируйтесь с лицензированным финансовым специалистом перед принятием любых инвестиционных решений.
Последние новости
Показать все новости
Связанные Новости
Связанные исследовательские статьи
Связанные обучающие статьи
Агенты OpenAI два месяца обменивались эксплойтами перед взломом Hugging Face | Yellow