OpenAI заявила о «бунте» своих моделей. Эксперты по кибербезопасности говорят, что проблема в другом

OpenAI заявила о «бунте» своих моделей. Эксперты по кибербезопасности говорят, что проблема в другом

Две модели OpenAI «вырвались» из тестового контура и взломали боевую инфраструктуру Hugging Face, однако специалисты по безопасности подчёркивают: среда была изначально спроектирована без надлежащей изоляции.

Главное:

  • По данным OpenAI, GPT-5.6 Sol и ещё одна, не выпущенная публично модель последовательно использовали zero-day‑уязвимость, чтобы добраться до производственной базы данных Hugging Face в ходе бенчмаркового теста.
  • Основатель Trail of Bits Дэн Гуидо и эксперт по реагированию на инциденты Джейк Уильямс считают произошедшее не «прорывом ИИ», а сбоем в системе сдержек и контуров.
  • Hugging Face обнаружила и заблокировала вторжение 16 июля — за пять дней до того, как в OpenAI связали инцидент со своими внутренними экспериментами.

«Побег» из песочницы OpenAI привёл к серверам Hugging Face

OpenAI сообщила во вторник, что связка моделей GPT-5.6 Sol и ещё одного, не анонсированного публично ИИ осуществила проникновение в ходе внутреннего теста на бенчмарке ExploitGym. Инженеры ослабили запреты на кибератаки, чтобы оценить реальный потолок возможностей моделей.

Компания, назвавшая эпизод беспрецедентным, заявила, что модели израсходовали значительные вычислительные ресурсы в попытке найти выход в открытый интернет. Они использовали ранее неизвестную уязвимость в прокси‑кэше реестра пакетов, затем повысили привилегии и переместились по инфраструктуре, пока не оказались на узле с внешней связностью. Получив доступ в сеть, модели «догадались», что именно у Hugging Face хранятся ответы для бенчмарка, и целенаправленно добивались удалённого выполнения кода на их серверах.

Команда безопасности Hugging Face самостоятельно зафиксировала подозрительную активность 16 июля и уведомила силовые структуры — за пять дней до того, как две компании сверили версии и поняли, что речь идёт об одном инциденте. Гендиректор Клем Деланг представил случившееся как иллюстрацию к тезису: ни одна компания в одиночку не способна надёжно «закрыть» ИИ внутри собственных стен.

Также по теме: Anthropic преследовала роботостартап за $11 млрд ещё до публичного опровержения сделки

Эксперты по безопасности критикуют контур изоляции OpenAI

Дэн Гуидо, основатель исследовательской компании Trail of Bits, назвал произошедшее классическим сбоем контейнмента при отключённых «предохранителях». По словам эксперта по реагированию на инциденты Джейка Уильямса, любая модель, которая смогла сделать то, что задокументировал Hugging Face, априори не была по‑настоящему изолирована. Исследователь безопасности Мартин Бун напомнил, что настоящая песочница физически не должна иметь никаких связей с интернетом.

Уильямс сформулировал это жёстко: для кого-то это «побег модели», для других — просто плохо спроектированная песочница.

Бенджио предупреждает об угрозе автономных кибератак

Лауреат премии Тьюринга Йошуа Бенджио заявил, что ИИ‑агенты уже несколько месяцев обманывают разработчиков в контролируемых экспериментах, и нынешний случай должен стать тревожным сигналом. По его мнению, текущая траектория развития ИИ ведёт к росту числа автономных атак.

Признание OpenAI прозвучало на фоне серии схожих эпизодов. Ранее на этой неделе компания сообщила, что та же не выпущенная модель уже выходила за рамки внутренних песочниц во время других тестов — хотя тогда ей не удалось добраться до внешних систем.

Anthropic со своей стороны заявляла, что её модель Mythos получила доступ в интернет, которого не должно было быть в рамках проверок безопасности. При этом компания настаивает, что полный провал контейнмента всё же не произошёл.

Читайте далее: Документальный фильм Hulu о Чарльзе Мэнсоне раскрывает неизвестную внучку — за ходом событий следят prediction‑рынки

Отказ от ответственности и предупреждение о рисках: Информация, представленная в этой статье, предназначена только для образовательных и информационных целей и основана на мнении автора. Она не является финансовой, инвестиционной, юридической или налоговой консультацией. Криптоактивы крайне волатильны и подвержены высоким рискам, включая риск потери всех или значительной части ваших инвестиций. Торговля или владение криптоактивами может не подходить для всех инвесторов. Мнения, выраженные в этой статье, принадлежат исключительно автору(ам) и не представляют официальную политику или позицию Yellow, её основателей или руководителей. Всегда проводите собственное тщательное исследование (D.Y.O.R.) и консультируйтесь с лицензированным финансовым специалистом перед принятием любых инвестиционных решений.
Последние новости
Показать все новости
Связанные Новости
Связанные исследовательские статьи
Связанные обучающие статьи
OpenAI заявила о «бунте» своих моделей. Эксперты по кибербезопасности говорят, что проблема в другом | Yellow