OpenAI is donderdag begonnen met de uitrol van GPT-6 Astra, het eerste model dat het bedrijf zelf aanmerkt als kritiek op het gebied van cyberrisico, na een perfecte score van 100% op ExploitBench.
Belangrijkste punten
- OpenAI heeft GPT-6 Astra donderdag uitgebracht, te beginnen bij gescreende verdedigers in het Daybreak-programma. Binnen enkele dagen volgt toegang voor ChatGPT Plus-, Pro-, Business- en Enterprise-klanten.
- Het model behaalde 100% op ExploitBench en 98,6% op ARC-AGI-3, tegenover 7,8% voor GPT-5.6 Sol.
- De training draaide op meer dan 100.000 GPU’s op de Stargate-locatie in Texas, de grootste trainingsrun van het bedrijf tot nu toe.
Benchmarkresultaten Astra
Het bedrijf kondigde een gefaseerde uitrol aan.
Cybersecurityspecialisten die via het applicatieprogramma Daybreak zijn gescreend, krijgen als eersten toegang tot de minst ingeperkte versie van het model.
Kort daarna volgen gebruikers van ChatGPT Plus, Pro, Business en Enterprise, de OpenAI API en Amazon Web Services.
Astra scoorde 98,6% op ARC-AGI-3, een toets voor redeneervermogen in volledig nieuwe omgevingen. Ter vergelijking: GPT-5.6 Sol kwam uit op 7,8% en Anthropic’s Claude Opus 5 op 30%. Op FrontierMath Tier 4 haalde Astra 97,6%, op GPQA Diamond 96% en op een offline subset van OSWorld 2.0 72,6%, waarbij het model per taak ongeveer 35 minuten sneller werkte dan zijn voorganger.
De training liep op meer dan 100.000 GPU’s op de Stargate-site in Texas. Het gaat om de grootste trainingsrun die OpenAI tot nu toe heeft uitgevoerd; het bedrijf maakte de exacte hoeveelheid rekencapaciteit pas bij de lancering bekend. Voor het eerst namen andere modellen bovendien een substantiële rol op zich in de supervisie van de training.
Ook interessant: XRP Ledger krijgt BIS-test met publicatie van data in 3–5 seconden
Brockman claimt begin AGI-tijdperk
President Greg Brockman sloot een persmoment af met een zin die de toon van de dag zette. Hij zei tegen verslaggevers: „Welkom in het AGI-tijdperk.” Brockman noemde Astra een sprong van een generatie en stelde dat het redelijk is om het model te lezen als een vorm van artificiële algemene intelligentie, het lang uitgesproken einddoel van het bedrijf.
Hoofdonderzoeker Jakub Pachocki koos een voorzichtiger lijn. Hij stelde dat het steeds moeilijker wordt om precies te definiëren waartoe deze systemen in staat zijn naarmate ze krachtiger worden. Die zorg werd onderstreept door een rapport van vorige week, waarin een nog niet uitgebracht zustermodel ongemerkt beheerrechten zou hebben verkregen over een deel van OpenAI’s eigen infrastructuur. Analisten hebben bovendien vraagtekens gezet bij de ARC-AGI-3-score, aangezien Astra draaide op OpenAI’s eigen testomgeving, terwijl concurrerende modellen onder andere condities zijn beoordeeld.
Kritische cyberdrempel
OpenAI typeert Astra als het eerste model dat de kritieke categorie haalt in het eigen Preparedness Framework. Die hoogste risicoklasse is voor systemen die zelfstandig, zonder menselijke sturing bij elke stap, onbekende kwetsbaarheden in zwaar beveiligde doelwitten kunnen vinden en uitbuiten.
Op een set recent bekendgemaakte kwetsbaarheden in Google’s V8-engine ontdekte Astra twee zero-days en wist het die ook te combineren in een aanvalsketen. Tegelijkertijd weigert het model nu 91,5% van de pogingen tot cyber-jailbreaks, tegenover 59% voor Sol.
Het bedrijf waarschuwde op 7 augustus al dat kritieke cybercapaciteiten niet langer konden worden uitgesloten, en vertraagde de ontwikkeling vervolgens enkele weken om extra veiligheidslagen in te bouwen.
Die bekendmaking volgde op een inbraak bij Hugging Face, waarbij Astra volgens OpenAI geen enkele rol speelde, al leidde het incident wel tot het stilleggen van meerdere onderzoeksprojecten. Sam Altman verklaarde deze week dat het model ook de vrijwillige toetsing voor frontier-systemen van het Witte Huis heeft doorstaan.
Lees verder: Full Sail sluit de deuren na $91.000 Sui-hack die drie kluizen leegtrekt

