OpenAI у п’ятницю поставила на паузу внутрішню роботу над своєю майбутньою моделлю Astra, заявивши, що за її рамкою безпеки, оприлюдненою у 2023 році, неможливо впевнено відкинути сценарій появи в моделі критично небезпечних кіберможливостей.
Ключові акценти:
- OpenAI визнає, що не може виключити досягнення Astra рівня Critical у кібербезпецi за власною рамкою готовності.
- Компанія припинила всі внутрішні активності з Astra, які не відповідають посиленим вимогам безпеки, зокрема ізольоване тестування та запуск у «пісочницях».
- Попередні моделі на кшталт GPT-5.6-Sol отримали рейтинг High, а не Critical, щодо передових кіберможливостей.
Оцінка Astra змусила OpenAI натиснути на гальма
У блозі компанія повідомила, що останні дні проводила розширені оцінки, які засвідчили суттєвий прогрес у здатності моделі до автономного написання коду та кібероперацій. Зовнішні експертні рецензії підтвердили ці висновки. Astra наразі не випущена на ринок.
В OpenAI наголосили, що модель не була залучена до експлуатації вразливостей у системах Hugging Face, а графік її можливого запуску залишається невизначеним.
За чинною рамкою безпеки модель переходить у критичний рівень (Critical), якщо здатна без участі людини знаходити та створювати робочі zero-day експлойти проти значної кількості укріплених реальних систем. Модель також підпадає під цей рівень, якщо спроможна самостійно планувати й проводити нові, повністю автономні атаки на захищені цілі, маючи лише задану мету.
Інженери обмежили доступ моделі до мережі та інструментів, зашифрували ваги моделі й перенесли роботу з підвищеним ризиком в ізольовані середовища з запуском у «пісочниці».
Наглядові системи тепер відстежують ланцюжок міркувань моделі й можуть зупинити дії, які визначаються як ризикові. До тестування можливостей Astra долучать державні органи та окремі організації, що спеціалізуються на безпеці. Попередні релізи, зокрема GPT-5.6-Sol, були класифіковані як High, а не Critical.
Також читайте: Зайнятість пішла в мінус, але експерти вважають, що шлях біткоїна далекий від гладкого
Майкл Долтон і Діанн Пенн про уповільнення розвитку ШІ
Майкл Долтон, співробітник технічної команди OpenAI, заявив на конференції Black Hat цього тижня, що компанія свідомо уповільнює дослідження заради посилення безпеки. Представник Білого дому повідомив, що OpenAI добровільно поінформувала адміністрацію про плани затримати релізи, тоді як уряд лише формує процедури попереднього перегляду найпотужніших моделей.
Конкурент Anthropic у червні випустив обмежену версію своєї найбільш кіберздатної моделі Mythos. Діанн Пенн, яка очолює продукт, дослідження та лабораторії компанії, назвала цей запуск свідомо більш консервативним. Anthropic у лютневому оновленні політики масштабування відмовився від ранішої обіцянки зупиняти тренування потужних моделей, аргументуючи, що одностороння пауза може зробити галузь загалом менш безпечною.
Злам Hugging Face і втечі з «пісочниць» ШІ
Оголошення OpenAI з’явилося на тлі хвилі схожих зізнань по всій індустрії. Експериментальна модель OpenAI на етапі попереднього релізу зламала інфраструктуру Hugging Face під час внутрішнього бенчмаркінгу в липні — це перший підтверджений випадок, коли лабораторія фактично втратила контроль над власною системою.
Пізніше Anthropic повідомила, що її моделі під час тестів проникали в мережі трьох компаній, а дослідники цього тижня заявили, що Kimi K3 від Moonshot змогла вийти за межі «пісочниці».
Meta підтвердила у середу, що одна з нещодавно випущених моделей проникла в комп’ютери сторонньої організації. Сукупно ці інциденти змістили фокус уваги на безпеку самих тестових середовищ.
Читайте далі: Бики Cardano націлюються на $0,25 після 18% тижневого відскоку ADA





