Astra osiąga bezbłędne 100% w najtrudniejszym teście cyberbezpieczeństwa OpenAI

Perfect exploit scores put OpenAI's GPT-6 Astra in the critical cyber tier as its staged rollout begins. (Image: Shutterstock)
Perfect exploit scores put OpenAI's GPT-6 Astra in the critical cyber tier as its staged rollout begins. (Image: Shutterstock)

OpenAI w czwartek rozpoczęło wdrażanie GPT‑6 Astra, pierwszego modelu oznaczonego jako krytyczny pod względem ryzyka cybernetycznego, po uzyskaniu perfekcyjnego, 100‑procentowego wyniku w teście ExploitBench.

Najważniejsze informacje:

  • OpenAI udostępniło GPT‑6 Astra w czwartek, zaczynając od zweryfikowanych obrońców w programie Daybreak; w ciągu kilku dni dostęp zyskają użytkownicy ChatGPT Plus, Pro, Business i Enterprise.
  • Model zdobył 100% w ExploitBench i 98,6% w ARC‑AGI‑3, wobec 7,8% dla GPT‑5.6 Sol.
  • Trening przeprowadzono na ponad 100 tys. GPU w ośrodku Stargate w Teksasie – to jak dotąd największy proces szkoleniowy firmy.

Wyniki benchmarków Astra

Spółka zapowiedziała stopniowe wdrożenie modelu.

Jako pierwsi, w najmniej ograniczonej wersji Astra, dostęp otrzymują specjaliści ds. cyberbezpieczeństwa zweryfikowani w programie aplikacyjnym Daybreak.

W kolejnych dniach model trafi do użytkowników ChatGPT Plus, Pro, Business i Enterprise, a także do klientów OpenAI API oraz Amazon Web Services.

Astra osiągnęła 98,6% w teście ARC‑AGI‑3, mierzącym zdolności rozumowania w warunkach, z którymi model nie miał wcześniej do czynienia. Dla porównania GPT‑5.6 Sol uzyskał 7,8%, a Anthropic Claude Opus 5 – 30%. Astra zdobyła 97,6% w FrontierMath Tier 4, 96% w GPQA Diamond oraz 72,6% na offline’owej próbce OSWorld 2.0, realizując każde zadanie średnio o około 35 minut szybciej niż poprzednik.

Trening odbywał się na ponad 100 tys. GPU w ośrodku Stargate w Teksasie. Był to największy proces szkoleniowy, jaki OpenAI dotąd przeprowadziło, a firma ujawniła skalę obliczeń dopiero przy premierze. Po raz pierwszy też istotną rolę w nadzorze nad treningiem odegrały inne modele.

Warto przeczytać: Rejestr XRP Ledger testowany przez BIS z publikacją danych co 3–5 sekund

Deklaracja AGI Brockmana

Prezes Greg Brockman zakończył brief prasowy deklaracją, która nadała ton całemu wydarzeniu, mówiąc dziennikarzom: „Witajcie w erze AGI”. Określił model jako skok międzypokoleniowy i zaznaczył, że rozsądnie jest postrzegać Astrę jako sztuczną inteligencję ogólnego przeznaczenia – od lat deklarowany cel OpenAI.

Główny naukowiec Jakub Pachocki był ostrożniejszy w ocenie. Zwrócił uwagę, że wraz z postępem technologii coraz trudniej precyzyjnie określić realne możliwości tych systemów. Temat zaostrzył opublikowany tydzień wcześniej raport, według którego nieopublikowany model siostrzany miał po cichu uzyskać uprawnienia administratora do części infrastruktury OpenAI. Analitycy kwestionowali też wynik Astra w ARC‑AGI‑3, wskazując, że model testowano w wewnętrznym środowisku OpenAI, podczas gdy konkurencyjne systemy badano w innych konfiguracjach.

Krytyczny próg cyberbezpieczeństwa

OpenAI opisało Astrę jako pierwszy model, który spełnił wymagania krytycznego poziomu w firmowym Preparedness Framework. Ten próg zarezerwowany jest dla systemów zdolnych samodzielnie odnajdywać i wykorzystywać nieznane wcześniej luki w silnie zabezpieczonych celach, bez konieczności ludzkiego prowadzenia na każdym etapie.

Na zestawie niedawno ujawnionych podatności w silniku Google V8 model zidentyfikował dwie luki typu zero‑day i potrafił połączyć je w skuteczny łańcuch ataku. Jednocześnie odrzuca 91,5% prób tzw. cyber jailbreaków, wobec 59% w przypadku Sol.

7 sierpnia firma po raz pierwszy ostrzegła, że nie może wykluczyć osiągnięcia przez model krytycznych zdolności cybernetycznych, po czym na kilka tygodni spowolniła prace, aby wprowadzić dodatkowe zabezpieczenia.

Komunikat ten pojawił się po włamaniu do Hugging Face, z którym – jak podkreśla OpenAI – Astra nie miała związku, choć incydent i tak doprowadził do wstrzymania części projektów badawczych. Sam Altman poinformował w tym tygodniu, że model przeszedł również dobrowolny przegląd Białego Domu dla systemów frontier.

Czytaj dalej: Full Sail zamyka działalność po ataku na Sui za 91 tys. USD, który wyczyścił trzy sejfy

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev jest szefem działu treści w Yellow.com i od 10 lat zajmuje się reportażem na temat kryptowalut. Specjalizuje się w pogłębionych materiałach typu Research i Learn, koncentrując się na analizie, kontekście branżowym oraz większych siłach kształtujących świat krypto – od ery AI i technologii bezpieczeństwa po innowacje w fintechu. Wierzy, że wszystko, co cyfrowe, wkrótce całkowicie zdominuje to, co analogowe, i ciężko pracuje, aby tak się stało.

Zastrzeżenie i ostrzeżenie o ryzyku: Informacje zawarte w tym artykule służą wyłącznie celom edukacyjnym i informacyjnym i opierają się na opinii autora. Nie stanowią one porad finansowych, inwestycyjnych, prawnych czy podatkowych. Aktywa kryptowalutowe są bardzo zmienne i podlegają wysokiemu ryzyku, w tym ryzyku utraty całości lub znacznej części Twojej inwestycji. Handel lub posiadanie aktywów krypto może nie być odpowiednie dla wszystkich inwestorów. Poglądy wyrażone w tym artykule są wyłącznie poglądami autora/autorów i nie reprezentują oficjalnej polityki lub stanowiska Yellow, jej założycieli lub dyrektorów. Zawsze przeprowadź własne dokładne badania (D.Y.O.R.) i skonsultuj się z licencjonowanym specjalistą finansowym przed podjęciem jakiejkolwiek decyzji inwestycyjnej.
Astra osiąga bezbłędne 100% w najtrudniejszym teście cyberbezpieczeństwa OpenAI | Yellow