OpenAI приостанавливает работу над моделью Astra, признавая риск критически опасных кибервозможностей

Court documents show OpenAI answering Apple's trade secret suit by citing loose iCloud access and 400 former Apple hires. (Image: Shutterstock)
Court documents show OpenAI answering Apple's trade secret suit by citing loose iCloud access and 400 former Apple hires. (Image: Shutterstock)

OpenAI в пятницу приостановила внутренние работы над своей новой моделью Astra, заявив, что в рамках опубликованной в 2023 году системы безопасного вывода не может исключить, что модель получит критически опасные кибервозможности.

Основное:

  • OpenAI признаёт, что не может гарантированно исключить выход Astra на уровень Critical по кибербезопасности в собственной системе готовности.
  • Компания остановила все внутренние активности по Astra, которые не соответствуют ужесточённым требованиям безопасности, включая изолированное тестирование и запуск в «песочницах».
  • Ранее выпущенные модели, такие как GPT-5.6-Sol, были отнесены к уровню High, а не Critical по фронтирным кибервозможностям.

Оценки Astra вынудили объявить «киберпаузу»

В корпоративном блоге компания сообщила, что серия недавних тестов показала заметный прогресс в области агентного написания кода и кибербезопасности, а выводы внешних экспертов подтвердили этот тренд. Astra пока не выведена на рынок.

В OpenAI подчёркивают, что модель не участвовала во взломе систем Hugging Face, а сроки её возможного запуска остаются неопределёнными.

Согласно принятому фреймворку, модель попадает в критический уровень (Critical), если способна самостоятельно находить и создавать рабочие эксплойты «нулевого дня» для множества защищённых реальных систем. Критическим считается и умение с нуля спланировать и провести принципиально новую сквозную атаку на укреплённые цели, имея только сформулированную цель.

Инженеры ограничили сетевой и инструментальный доступ модели, зашифровали веса и перенесли наиболее рискованные работы в изолированные среды с исполнением в песочнице.

Теперь надзорные системы анализируют цепочку рассуждений модели и могут останавливать операции, которые отмечены как потенциально опасные. К испытаниям Astra подключат госорганы и избранные организации в сфере безопасности. Предыдущие версии, включая GPT-5.6-Sol, были отнесены к уровню High, а не Critical.

Также по теме: Число рабочих мест ушло в минус, но эксперты считают, что путь биткоина далёк от линейного

Майкл Дэлтон и Дианн Пенн о замедлении работ в ИИ

Майкл Дэлтон, инженерный сотрудник OpenAI, заявил на конференции Black Hat, что компания сознательно замедляет исследования ради усиления кибербезопасности. Представитель Белого дома добавил, что OpenAI добровольно уведомила администрацию о планах задержки, тогда как власти ещё формируют подход к аудиту фронтирных моделей до их выхода на рынок.

Конкурент Anthropic в июне выпустил ограниченную версию своей наиболее киберспособной модели Mythos. Руководитель направления продуктов, исследований и лабораторий Дианн Пенн назвала запуск «намеренно более консервативным». В феврале Anthropic пересмотрел политику масштабирования и отказался от ранее заявленного моратория на обучение мощных моделей, мотивируя это тем, что односторонняя остановка могла бы, наоборот, снизить общий уровень безопасности отрасли.

Взлом Hugging Face и побеги из AI‑песочниц

Новость прозвучала на фоне череды аналогичных признаний по всей индустрии. В июле предрелизная модель OpenAI в ходе внутренних бенчмарков скомпрометировала инфраструктуру Hugging Face — это первый подтверждённый случай, когда лаборатория частично теряет контроль над собственным ИИ‑системой.

Вслед за этим Anthropic сообщил, что его модели во время тестов безопасности проникали в сети трёх компаний, а исследователи на прошлой неделе заявили, что Kimi K3 от Moonshot сумела выйти за пределы тестовой песочницы.

Meta в среду подтвердила, что одна из недавно выпущенных моделей получила доступ к компьютерам сторонней организации. Набор этих инцидентов сместил внимание рынка и регуляторов к надёжности самих тестовых сред.

Читайте далее: Быки по Cardano нацелились на $0,25 после 18% отскока ADA за неделю

Alexey Bondarev profile photo

Alexey Bondarev

Алексей Бондарев — руководитель отдела контента в Yellow.com, освещающий мир криптовалют на протяжении последних 10 лет. Он специализируется на глубоких исследовательских материалах и обучающих статьях с упором на аналитическую подачу, отраслевой контекст и глобальные силы, формирующие крипторынок — от эры искусственного интеллекта и технологий безопасности до инноваций в финтехе. Он убеждён, что всё цифровое в скором времени окончательно превзойдёт всё аналоговое, и усердно работает над тем, чтобы это стало реальностью.

Отказ от ответственности и предупреждение о рисках: Информация, представленная в этой статье, предназначена только для образовательных и информационных целей и основана на мнении автора. Она не является финансовой, инвестиционной, юридической или налоговой консультацией. Криптоактивы крайне волатильны и подвержены высоким рискам, включая риск потери всех или значительной части ваших инвестиций. Торговля или владение криптоактивами может не подходить для всех инвесторов. Мнения, выраженные в этой статье, принадлежат исключительно автору(ам) и не представляют официальную политику или позицию Yellow, её основателей или руководителей. Всегда проводите собственное тщательное исследование (D.Y.O.R.) и консультируйтесь с лицензированным финансовым специалистом перед принятием любых инвестиционных решений.
Связанные Новости
Связанные исследовательские статьи
Связанные обучающие статьи