OpenAI заявляє, що модель Astra може наблизитися до критичного (Critical) порогу кібербезпеки після того, як нерелізована версія моделі отримала 10 великих математичних результатів і продемонструвала стрімкий прогрес в автономній кібердіяльності.
Ключові моменти:
- OpenAI 7 серпня заявила, що більше не може виключати вихід Astra на рівень Critical за показниками кібербезпеки.
- Компанія призупинила частину внутрішніх робіт із Astra, посилюючи системи захисту, «пісочниці» та моніторинг.
- Astra також згенерувала 10 дослідницьких результатів, які розв’язали або суттєво просунули давні задачі в математиці й теоретичній інформатиці.
Кіберризики Astra
OpenAI 7 серпня повідомила, що внутрішні оцінювання засвідчили суттєвий прогрес моделі в агентному програмуванні та кібербезпеці — настільки, що компанія вже не може виключати досягнення Astra критичного рівня за власною Preparedness Framework. Водночас OpenAI не стверджує, що модель уже відповідає цьому порогу; оцінка залишається попередньою.
У рамках підходу OpenAI модель рівня Critical — це система, здатна автономно розробляти робочі «нульові дні» (zero‑day) проти широкого спектра захищених критичних систем або проводити принципово нові наскрізні атаки, починаючи лише з загальної високорівневої цілі. OpenAI посилює контроль доступу до мережі й інструментів, захист ваг моделі, шифрування та ізоляцію середовищ, а також розширює моніторинг агентних сценаріїв використання Astra.
Компанія також призупинила всі активності з Astra, які поки не відповідають оновленим жорсткішим вимогам безпеки, і заявила, що співпрацюватиме з держорганами та вибраними структурами з безпеки ШІ для додаткових тестів. 1 серпня OpenAI описувала Astra як «нашу наступну велику модель». Уже 7 серпня формулювання змінилося на «одну з наших майбутніх моделей».
Читайте також: Bitcoin наближається до форку BIP-110 вже цієї суботи за підтримки лише 2,59% майнерів
Дискусія навколо математики
Кіберпопередження пролунало після того, як OpenAI розкрила: внутрішня версія Astra отримала 10 результатів у напрямах, зокрема, квантової складності, ґраткової криптографії, теорії кодів і екстремальної комбінаторики. За оцінкою OpenAI, ці напрацювання розв’язали або помітно просунули давні відкриті задачі, а їхня собівартість склала близько $2 000 у токенах за тарифами Sol API.
Ендрю Блумберг (Andrew Blumberg), професор Колумбійського університету та член ради First Proof, у коментарі для Mashable назвав результати вражаючими, але такими, що не змінюють його оцінки поточних можливостей ШІ. За його словами, багато з них — це лаконічні контрприклади або «невеликі, надзвичайно витончені конструкції» на базі вже відомих робіт. «Вони не змінюють моїх апріорних уявлень», — зазначив він.
Попри це, результати демонструють, як передові моделі можуть ставати корисними співдослідниками в науці, одночасно створюючи паралельну проблему безпеки — коли ті самі навички кодування застосовуються до зламів програмного забезпечення.
Ця напруга нині визначає, як OpenAI ухвалює рішення щодо доступу до моделей та їхнього розгортання.
До Astra OpenAI оцінила GPT‑5.6 Sol на рівні High за показниками кібербезпеки, а не Critical. Попередня модель могла допомагати у виявленні вразливостей і завданнях з експлуатації, однак, за словами компанії, не демонструвала стабільних автономних атак проти добре захищених цілей. На цьому тлі поточна оцінка Astra виглядає суттєвою ескалацією ризиків.
Читайте далі: Дата виходу iPhone Fold вказує на 18 вересня, але одностайності немає





