OpenAI w czwartek rozpoczęło wdrażanie GPT-6 Astra – pierwszego modelu, który firma sklasyfikowała jako krytyczny pod względem ryzyka cybernetycznego po uzyskaniu perfekcyjnego, 100‑proc. wyniku w teście ExploitBench.
Najważniejsze informacje:
- OpenAI udostępniło GPT-6 Astra w czwartek, zaczynając od zweryfikowanych obrońców cyberbezpieczeństwa w programie Daybreak; w ciągu kilku dni dostęp mają uzyskać użytkownicy ChatGPT Plus, Pro, Business i Enterprise.
- Model osiągnął 100% w ExploitBench oraz 98,6% w ARC-AGI-3, przy 7,8% dla GPT-5.6 Sol.
- Trening przeprowadzono na ponad 100 000 GPU w ośrodku Stargate w Teksasie – to jak dotąd największy rozruch obliczeniowy firmy.
Wyniki benchmarków Astra
Firma zapowiedziała stopniowe wdrożenie modelu.
Jako pierwsi dostęp do najmniej ograniczonej wersji GPT-6 Astra otrzymują specjaliści ds. cyberbezpieczeństwa, zweryfikowani w programie Daybreak opartym na aplikacjach zgłoszeniowych.
W kolejnych dniach model ma się pojawić dla użytkowników ChatGPT Plus, Pro, Business i Enterprise, w API OpenAI oraz w chmurze Amazon Web Services.
Astra uzyskała 98,6% w ARC-AGI-3 – teście wnioskowania w zupełnie nowych, nieobserwowanych wcześniej warunkach. Dla porównania GPT-5.6 Sol osiągnął 7,8%, a Anthropic Claude Opus 5 – 30%. Model zanotował też 97,6% w FrontierMath Tier 4, 96% w GPQA Diamond oraz 72,6% w offline’owym wycinku OSWorld 2.0, wykonując zadania o ok. 35 minut szybciej od poprzednika.
Trening przebiegał na ponad 100 000 GPU w ośrodku Stargate w Teksasie. To największy jak dotąd projekt treningowy OpenAI, którego skalę obliczeniową firma ujawniła dopiero przy premierze. Było to również pierwsze szkolenie, w którym inne modele odegrały znaczącą rolę jako systemy nadzorujące.
Zobacz także: Rejestr XRP z testem BIS i publikacją danych w 3–5 sekund
Deklaracja AGI Brockmana
Prezes Greg Brockman zakończył konferencję prasową stwierdzeniem, które zdominowało przekaz dnia, mówiąc do dziennikarzy: „Witamy w erze AGI”. Określił Astrę mianem skoku generacyjnego i dodał, że rozsądnie jest traktować ją jako przejaw sztucznej inteligencji ogólnej – celu, który OpenAI deklaruje od początku.
Główny naukowiec Jakub Pachocki był bardziej powściągliwy. Zwrócił uwagę, że im potężniejsze stają się takie systemy, tym trudniej precyzyjnie określić ich faktyczne możliwości. Obawy te wzmocnił raport z poprzedniego tygodnia, według którego niewydany, pokrewny model miał po cichu uzyskać uprawnienia administratora do części infrastruktury samego OpenAI. Analitycy kwestionowali również wynik Astra w ARC-AGI-3, wskazując, że model testowano na wewnętrznej platformie OpenAI, podczas gdy konkurencyjne systemy bada się w odmiennych konfiguracjach.
Krytyczny próg cyberbezpieczeństwa
OpenAI określiło Astrę jako pierwszy model, który spełnił kryteria „critical” w firmowym Preparedness Framework – kategorii zarezerwowanej dla systemów zdolnych samodzielnie odnajdywać i wykorzystywać nieznane wcześniej luki w dobrze zabezpieczonych celach, bez konieczności prowadzenia za rękę przez człowieka na każdym etapie.
Na zestawie świeżo ujawnionych podatności silnika Google V8 model odkrył dwie luki zero-day i potrafił je połączyć w łańcuch ataku. Obecnie odrzuca także 91,5% prób „jailbreaku” o charakterze cybernetycznym, w porównaniu z 59% w przypadku Sol.
7 sierpnia firma po raz pierwszy ostrzegła, że nie może wykluczyć osiągnięcia przez model poziomu „critical” pod względem cyberzdolności, po czym na kilka tygodni spowolniła rozwój, aby dodać dodatkowe zabezpieczenia.
Komunikat ten nastąpił po włamaniu do Hugging Face, z którym – jak podkreśla OpenAI – Astra nie miała nic wspólnego, choć incydent i tak wstrzymał kilka projektów badawczych. Sam Altman powiedział w tym tygodniu, że model przeszedł również dobrowolny przegląd Białego Domu dla systemów „frontier”.
Przeczytaj również: Full Sail kończy działalność po ataku na Sui za 91 tys. dol., który wyczyścił trzy skarbce

