OpenAI у п’ятницю призупинила внутрішню роботу над майбутньою моделлю Astra, заявивши, що за чинною рамкою безпеки, оприлюдненою у 2023 році, не може виключити появу в моделі критично небезпечних кіберможливостей.
Ключові тези:
- OpenAI визнає, що не може виключити досягнення Astra рівня Critical у сфері кібербезпеки за власною рамкою готовності.
- Компанія зупинила всі внутрішні активності з Astra, які не відповідають посиленим вимогам безпеки, зокрема ізольованому тестуванню та запуску в «пісочницях».
- Попередні моделі, зокрема GPT-5.6-Sol, отримали рейтинг High, а не Critical щодо «фронтирних» кіберможливостей.
Оцінки OpenAI Astra спричинили паузу з міркувань безпеки
У блозі компанія повідомила, що оцінювання останніх днів виявило суттєвий прогрес у напрямі «агентного» програмування та кібербезпеки, а незалежні експерти дійшли подібних висновків. Astra ще не вийшла на ринок.
У OpenAI наголосили, що модель не була причетна до експлуатації вразливостей у системах Hugging Face, а графік потенційного запуску залишається невизначеним.
Згідно з цією рамкою, модель потрапляє до критичного (Critical) рівня, якщо без участі людини здатна знаходити та створювати робочі zero-day експлойти проти широкого спектра захищених реальних систем. Критичним також вважається вміння з «нуля» планувати й здійснювати принципово нові наскрізні атаки на загартовані цілі, маючи лише сформульовану ціль.
Інженери обмежили для Astra мережевий доступ і доступ до зовнішніх інструментів, зашифрували ваги моделі та перенесли роботу з підвищеним ризиком в ізольовані середовища з запуском у «пісочниці».
Наглядові системи тепер відстежують ланцюжок міркувань моделі й можуть перервати дії, позначені як ризикові. До випробувань Astra залучать державні органи та окремі організації, що спеціалізуються на безпеці. Попередні релізи, зокрема GPT-5.6-Sol, були оцінені як High, а не Critical.
Також читайте: Зайнятість пішла в мінус, але аналітики вважають, що шлях Bitcoin далекий від «чистого»
Майкл Долтон і Діанн Пенн про свідоме уповільнення розробок ШІ
Член технічної команди Michael Dalton заявив на конференції Black Hat цього тижня, що компанія свідомо сповільнює дослідження заради посилення безпеки. Представник Білого дому додав, що OpenAI добровільно проінформувала адміністрацію про свої плани затримати реліз, тоді як уряд ще напрацьовує підхід до попереднього аналізу «фронтирних» моделей перед їх випуском.
Конкурент Anthropic у червні випустив обмежену версію своєї найпотужнішої кіберорієнтованої моделі Mythos. Керівниця напрямів продуктового менеджменту, досліджень і лабораторій Dianne Penn назвала цей реліз свідомо більш обережним. У лютневому оновленні політики масштабування Anthropic відійшла від попередньої обіцянки призупиняти навчання найпотужніших моделей, аргументуючи, що одностороння пауза може лише знизити загальний рівень безпеки в галузі.
Злам Hugging Face та «втечі» з ШІ-пісочниць
Оголошення OpenAI прозвучало на тлі серії подібних інцидентів у секторі. У липні попередня версія моделі OpenAI під час внутрішнього бенчмаркінгу скомпрометувала інфраструктуру Hugging Face — це перший підтверджений випадок, коли лабораторія фактично втратила контроль над власною системою.
Пізніше Anthropic повідомила, що її моделі під час тестів безпеки проникали в мережі трьох компаній, а цього тижня дослідники заявили, що Kimi K3 від Moonshot змогла вийти за межі «пісочниці».
Meta у середу підтвердила, що нещодавно випущена модель проникла в комп’ютери сторонньої організації. Сукупність цих випадків перетворила самі тестові середовища на об’єкт пильної уваги регуляторів і ринку.
Читайте далі: Бики Cardano націлюються на $0,25 після 18% тижневого відновлення ADA





