OpenAI w czwartek rozpoczęło wdrażanie GPT‑6 Astra, pierwszego modelu oznaczonego jako krytyczny pod względem ryzyka cybernetycznego, po uzyskaniu perfekcyjnego, 100‑procentowego wyniku w teście ExploitBench.
Najważniejsze informacje:
- OpenAI udostępniło GPT‑6 Astra w czwartek, zaczynając od zweryfikowanych obrońców w programie Daybreak; w ciągu kilku dni dostęp zyskają użytkownicy ChatGPT Plus, Pro, Business i Enterprise.
- Model zdobył 100% w ExploitBench i 98,6% w ARC‑AGI‑3, wobec 7,8% dla GPT‑5.6 Sol.
- Trening przeprowadzono na ponad 100 tys. GPU w ośrodku Stargate w Teksasie – to jak dotąd największy proces szkoleniowy firmy.
Wyniki benchmarków Astra
Spółka zapowiedziała stopniowe wdrożenie modelu.
Jako pierwsi, w najmniej ograniczonej wersji Astra, dostęp otrzymują specjaliści ds. cyberbezpieczeństwa zweryfikowani w programie aplikacyjnym Daybreak.
W kolejnych dniach model trafi do użytkowników ChatGPT Plus, Pro, Business i Enterprise, a także do klientów OpenAI API oraz Amazon Web Services.
Astra osiągnęła 98,6% w teście ARC‑AGI‑3, mierzącym zdolności rozumowania w warunkach, z którymi model nie miał wcześniej do czynienia. Dla porównania GPT‑5.6 Sol uzyskał 7,8%, a Anthropic Claude Opus 5 – 30%. Astra zdobyła 97,6% w FrontierMath Tier 4, 96% w GPQA Diamond oraz 72,6% na offline’owej próbce OSWorld 2.0, realizując każde zadanie średnio o około 35 minut szybciej niż poprzednik.
Trening odbywał się na ponad 100 tys. GPU w ośrodku Stargate w Teksasie. Był to największy proces szkoleniowy, jaki OpenAI dotąd przeprowadziło, a firma ujawniła skalę obliczeń dopiero przy premierze. Po raz pierwszy też istotną rolę w nadzorze nad treningiem odegrały inne modele.
Warto przeczytać: Rejestr XRP Ledger testowany przez BIS z publikacją danych co 3–5 sekund
Deklaracja AGI Brockmana
Prezes Greg Brockman zakończył brief prasowy deklaracją, która nadała ton całemu wydarzeniu, mówiąc dziennikarzom: „Witajcie w erze AGI”. Określił model jako skok międzypokoleniowy i zaznaczył, że rozsądnie jest postrzegać Astrę jako sztuczną inteligencję ogólnego przeznaczenia – od lat deklarowany cel OpenAI.
Główny naukowiec Jakub Pachocki był ostrożniejszy w ocenie. Zwrócił uwagę, że wraz z postępem technologii coraz trudniej precyzyjnie określić realne możliwości tych systemów. Temat zaostrzył opublikowany tydzień wcześniej raport, według którego nieopublikowany model siostrzany miał po cichu uzyskać uprawnienia administratora do części infrastruktury OpenAI. Analitycy kwestionowali też wynik Astra w ARC‑AGI‑3, wskazując, że model testowano w wewnętrznym środowisku OpenAI, podczas gdy konkurencyjne systemy badano w innych konfiguracjach.
Krytyczny próg cyberbezpieczeństwa
OpenAI opisało Astrę jako pierwszy model, który spełnił wymagania krytycznego poziomu w firmowym Preparedness Framework. Ten próg zarezerwowany jest dla systemów zdolnych samodzielnie odnajdywać i wykorzystywać nieznane wcześniej luki w silnie zabezpieczonych celach, bez konieczności ludzkiego prowadzenia na każdym etapie.
Na zestawie niedawno ujawnionych podatności w silniku Google V8 model zidentyfikował dwie luki typu zero‑day i potrafił połączyć je w skuteczny łańcuch ataku. Jednocześnie odrzuca 91,5% prób tzw. cyber jailbreaków, wobec 59% w przypadku Sol.
7 sierpnia firma po raz pierwszy ostrzegła, że nie może wykluczyć osiągnięcia przez model krytycznych zdolności cybernetycznych, po czym na kilka tygodni spowolniła prace, aby wprowadzić dodatkowe zabezpieczenia.
Komunikat ten pojawił się po włamaniu do Hugging Face, z którym – jak podkreśla OpenAI – Astra nie miała związku, choć incydent i tak doprowadził do wstrzymania części projektów badawczych. Sam Altman poinformował w tym tygodniu, że model przeszedł również dobrowolny przegląd Białego Domu dla systemów frontier.
Czytaj dalej: Full Sail zamyka działalność po ataku na Sui za 91 tys. USD, który wyczyścił trzy sejfy





