OpenAI в четверг начала поэтапный запуск GPT-6 Astra — первого ИИ, который компания официально отнесла к категории критического киберриска после идеальных 100% на ExploitBench.
Ключевые факты
- В четверг OpenAI запустила GPT-6 Astra, сначала для отобранных защитников в программе Daybreak; в течение ближайших дней доступ получат ChatGPT Plus, Pro, Business и Enterprise.
- Модель показала 100% на ExploitBench и 98,6% на ARC-AGI-3 против 7,8% у GPT-5.6 Sol.
- Обучение шло на более чем 100 000 GPU на объекте Stargate в Техасе — это крупнейший обучающий прогон в истории компании.
Результаты Astra в бенчмарках
Компания объявила о поэтапном релизе.
Первыми к наименее ограниченной версии модели получают доступ киберзащитники, прошедшие отбор через программу Daybreak на базе заявок.
Вслед за ними в течение нескольких дней GPT-6 Astra появится у пользователей ChatGPT Plus, Pro, Business и Enterprise, а также через OpenAI API и в облаке Amazon Web Services.
Astra набрала 98,6% на ARC-AGI-3 — тесте способности к рассуждению в ранее не встречавшихся сценариях. Для сравнения: GPT-5.6 Sol показала 7,8%, а Claude Opus 5 от Anthropic — 30%. В бенчмарке FrontierMath Tier 4 модель получила 97,6%, в GPQA Diamond — 96%, а на офлайн-срезе OSWorld 2.0 — 72,6%, выполняя задачи примерно на 35 минут быстрее предшественника.
Обучение проходило на более чем 100 000 GPU на объекте Stargate в Техасе. Это был крупнейший обучающий прогон, который когда-либо проводила компания; объем вычислений раскрыли лишь в день запуска. Впервые значимую роль в контроле за обучением играли другие ИИ-модели.
Также читайте: Сеть XRP Ledger проходит тест BIS с публикацией данных за 3–5 секунд
Заявление Брокмана об AGI
Президент OpenAI Грег Брокман завершил пресс-брифинг фразой, которая задала тон всему дню, заявив журналистам: «Добро пожаловать в эпоху AGI». Он назвал GPT-6 Astra «поколенческим скачком» и отметил, что вполне разумно рассматривать Astra как искусственный общий интеллект — давнюю целевую планку компании.
Главный научный сотрудник Якуб Пахоцки выступил осторожнее. Он отметил, что по мере усложнения систем становится все труднее четко описать реальные границы их возможностей. Этот тезис обострил недавний отчет о том, что неопубликованная «сестринская» модель незаметно получила админ-доступ к части собственной инфраструктуры OpenAI. Аналитики также ставят под вопрос результат Astra на ARC-AGI-3, указывая, что модель тестировалась в фирменной среде OpenAI, тогда как конкуренты проверялись в иных условиях.
Порог критического киберриска
OpenAI охарактеризовала Astra как первую модель, достигшую критического уровня в ее Framework по подготовленности — категории, зарезервированной для систем, способных самостоятельно находить и эксплуатировать неизвестные уязвимости в защищенных целях без пошагового ручного сопровождения.
На наборе недавно раскрытых уязвимостей в движке Google V8 модель выявила две zero‑day-дыры и связала их в единую цепочку атаки. При этом Astra блокирует 91,5% попыток кибер‑jailbreak против 59% у Sol.
Впервые компания предупредила 7 августа, что не может исключить возникновения критических кибервозможностей у модели, после чего на несколько недель притормозила разработку для внедрения дополнительных защитных механизмов.
Это раскрытие последовало за инцидентом взлома платформы Hugging Face, к которому, по словам OpenAI, Astra не имела отношения, хотя сам эпизод привел к приостановке ряда исследовательских проектов. Сэм Альтман заявил на этой неделе, что модель также прошла добровольный обзор Белого дома для передовых ИИ-систем.
Читайте далее: Full Sail закрывается после взлома на $91 тыс. в сети Sui, опустошившего три хранилища





