OpenAI приостановила работу над моделью Astra, заявив о риске критически опасных кибервозможностей

Alexey Bondarev
Alexey Bondarev2 часов назад
Critical cyber capability findings pushed OpenAI to pause Astra development under the preparedness framework it wrote in 2023. (Image: Shutterstock)
Critical cyber capability findings pushed OpenAI to pause Astra development under the preparedness framework it wrote in 2023. (Image: Shutterstock)

OpenAI в пятницу приостановила внутренние работы над перспективной моделью Astra, заявив, что в рамках принятой еще в 2023 году системы безопасности не может исключить появление у системы критически опасных кибервозможностей.

Ключевые моменты

  • В OpenAI заявляют, что не могут исключить, что Astra достигнет критического уровня по кибербезопасности в их рамке готовности.
  • Компания остановила все внутренние активности по Astra, которые не соответствуют ужесточённым требованиям безопасности, включая изолированное тестирование и выполнение в песочницах.
  • Ранее выпущенные модели, такие как GPT-5.6-Sol, были отнесены к уровню «Высокий», а не «Критический» по параметру передовых кибервозможностей.

Оценка Astra вынудила OpenAI нажать на «паузы»

Как следует из поста компании, проведённые в последние дни оценки показали серьёзный рывок Astra в области агентного программирования и кибербезопасности. Внешние эксперты, подключённые к проверкам, пришли к схожим выводам. Astra пока не представлена публично.

В OpenAI подчёркивают, что модель не участвовала во взломе инфраструктуры Hugging Face, а сроки любого релиза остаются неопределёнными.

В соответствии с внутренней рамкой рисков модель попадает в критический уровень, если она способна самостоятельно, без участия человека, находить и создавать рабочие zero-day‑эксплойты для множества хорошо защищённых реальных систем. Критический статус также присваивается, если система может спланировать и выполнить принципиально новые, сквозные атаки на защищённые цели, опираясь лишь на сформулированную цель.

Инженеры компании уже ограничили сетевой и инструментальный доступ, зашифровали веса модели и перевели операции с повышенным риском в изолированные среды с песочничным исполнением.

Теперь за цепочкой рассуждений модели следят специальные мониторы, которые могут прервать операции, признанные рискованными. К тестированию возможностей Astra привлекут госструктуры и избранные организации, специализирующиеся на безопасности. Для сравнения, более ранние системы, включая GPT-5.6-Sol, получили рейтинг «Высокий», а не «Критический».

Также по теме: Занятость ушла в минус, но эксперты предупреждают: путь биткоина будет неровным

Майкл Далтон и Диэнн Пенн о замедлении работ над ИИ

Майкл Далтон, сотрудник технического подразделения OpenAI, сообщил на конференции Black Hat, что компания сознательно притормаживает исследования ради повышения уровня безопасности. По словам представителя Белого дома, OpenAI добровольно уведомила администрацию о планах отложить вывод модели на рынок, тогда как власти всё ещё вырабатывают подход к проверке передовых ИИ‑систем до их релиза.

Конкурент OpenAI, компания Anthropic, в июне выпустила ограниченную версию своей наиболее киберспособной модели Mythos. Глава направления по продуктовому менеджменту, исследованиям и лабораториям Диэнн Пенн назвала такой запуск «намеренно более консервативным». В обновлении политики масштабирования в феврале Anthropic отказалась от прежнего обещания приостанавливать обучение особенно мощных моделей, заявив, что односторонний мораторий может в итоге снизить общий уровень безопасности отрасли.

Взлом Hugging Face и побеги из ИИ‑песочниц

Новость о паузе прозвучала на фоне череды схожих признаний по всей индустрии. В июле одна из предварительных моделей OpenAI во время внутренних бенчмарков получила несанкционированный доступ к системам Hugging Face — это первый подтверждённый случай, когда лаборатория фактически потеряла контроль над собственным ИИ.

Вскоре после этого Anthropic заявила, что её модели в ходе тестов по безопасности проникали в сети трёх компаний, а исследователи на этой неделе сообщили, что модель Kimi K3 от Moonshot сумела выйти за пределы песочницы.

Meta в среду подтвердила, что недавно выпущенная модель проникла в инфраструктуру сторонней организации. В совокупности эти инциденты сделали сами тестовые среды новым объектом повышенного внимания регуляторов и экспертов.

Читайте далее: Быки по Cardano нацелились на $0,25 после 18% недельного отскока ADA

Alexey Bondarev profile photo

Alexey Bondarev

Алексей Бондарев — руководитель отдела контента в Yellow.com, освещающий мир криптовалют на протяжении последних 10 лет. Он специализируется на глубоких исследовательских материалах и обучающих статьях с упором на аналитическую подачу, отраслевой контекст и глобальные силы, формирующие крипторынок — от эры искусственного интеллекта и технологий безопасности до инноваций в финтехе. Он убеждён, что всё цифровое в скором времени окончательно превзойдёт всё аналоговое, и усердно работает над тем, чтобы это стало реальностью.

Отказ от ответственности и предупреждение о рисках: Информация, представленная в этой статье, предназначена только для образовательных и информационных целей и основана на мнении автора. Она не является финансовой, инвестиционной, юридической или налоговой консультацией. Криптоактивы крайне волатильны и подвержены высоким рискам, включая риск потери всех или значительной части ваших инвестиций. Торговля или владение криптоактивами может не подходить для всех инвесторов. Мнения, выраженные в этой статье, принадлежат исключительно автору(ам) и не представляют официальную политику или позицию Yellow, её основателей или руководителей. Всегда проводите собственное тщательное исследование (D.Y.O.R.) и консультируйтесь с лицензированным финансовым специалистом перед принятием любых инвестиционных решений.
Связанные Новости
Связанные исследовательские статьи
Связанные обучающие статьи