OpenAI сообщила, что модель Astra может приблизиться к критическому порогу по кибербезопасности после того, как неразвернутая версия выдала 10 значимых математических результатов и продемонстрировала быстрый прогресс в автономной работе по киберзащите.
Ключевые моменты:
- 7 августа OpenAI заявила, что не может исключить, что Astra обладает критическими возможностями в сфере кибербезопасности.
- Компания приостановила часть внутренних работ над Astra и параллельно усиливает контроль доступа, изоляцию среды и мониторинг.
- Astra также сгенерировала 10 исследовательских результатов, решив или значительно продвинув давние задачи в математике и теоретической информатике.
Киберриски Astra
По данным OpenAI, внутренние тесты, проведённые 7 августа, показали крупный шаг вперёд в «агентном» программировании и кибербезопасности — настолько, что компания больше не может уверенно исключать достижение Astra критического уровня по собственной Preparedness Framework. При этом OpenAI не утверждает, что модель уже достигла этого порога: оценка остаётся предварительной.
В соответствии с этой рамкой, модель критического уровня способна самостоятельно разрабатывать практические zero-day-эксплойты против множества защищённых критически важных систем или выполнять новые сквозные атаки, исходя лишь из высокоуровневой цели. OpenAI заявила, что ужесточает сетевой и инструментальный доступ, защиту весов модели, шифрование и песочницы, а также расширяет мониторинг всех «агентных» сценариев использования Astra.
Компания также приостановила те виды активности с Astra, которые пока не удовлетворяют новым, более жёстким требованиям, и объявила о планах тестировать модель совместно с госструктурами и избранными организациями в области безопасности ИИ. 1 августа OpenAI описывала Astra как «нашу следующую крупную модель». Уже 7 августа её охарактеризовали более сдержанно — как «одну из наших будущих моделей».
Также по теме: Биткоин приближается к форку BIP-110 в эти выходные при поддержке лишь 2,59% майнеров
Дискуссия вокруг математики
Предупреждение по киберрискам последовало за раскрытием факта, что внутренняя версия Astra получила 10 новых результатов в областях, включая квантовую сложность, решётчатую криптографию, теорию кодов и экстремальную комбинаторику. По оценке OpenAI, эта работа либо закрыла, либо существенно продвинула давние открытые задачи, при этом затраты на вычисления составили около $2 000 в токенах по тарифам Sol API.
Эндрю Блумберг, профессор Колумбийского университета и член совета First Proof, заявил изданию Mashable, что результаты впечатляют, но не меняют его оценки нынешних возможностей ИИ. По его словам, многие из них представляют собой лаконичные контрпримеры или «небольшие, предельно изящные конструкции», опирающиеся на существующие работы. «Они не меняют мои приоритеты и исходные предположения», — отметил он.
Тем не менее эти результаты показывают, что передовые модели могут стать полезными партнёрами для исследователей, одновременно порождая зеркальный риск безопасности — когда та же способность к кодингу применяется к поиску и эксплуатации уязвимостей.
Это противоречие теперь определяет подход OpenAI к вопросу доступа к моделям и их развертывания.
До Astra OpenAI оценивала модель GPT-5.6 Sol как уровень High по кибербезопасности, а не Critical. Предыдущая модель могла помогать в поиске и эксплуатации уязвимостей, однако, по словам компании, она не демонстрировала надёжных автономных атак против хорошо защищённых целей. На этом фоне новая оценка Astra выглядит заметной эскалацией.
Читайте также: Дата выхода iPhone Fold указывает на 18 сентября, но консенсуса пока нет





