OpenAI is donderdag begonnen met de uitrol van GPT-6 Astra, het eerste model dat het bedrijf zelf aanmerkt als “kritiek” op het vlak van cyberrisico, na een perfecte score van 100% op ExploitBench.
Belangrijkste punten
- OpenAI heeft GPT-6 Astra donderdag vrijgegeven, te beginnen bij gescreende beveiligingsspecialisten in het Daybreak-programma. Binnen enkele dagen volgt toegang voor ChatGPT Plus-, Pro-, Business- en Enterprise-klanten.
- Het model scoorde 100% op ExploitBench en 98,6% op ARC-AGI-3, tegenover 7,8% voor GPT-5.6 Sol.
- De training draaide op meer dan 100.000 GPU’s op de Stargate-locatie in Texas, de grootste trainingsrun van het bedrijf tot nu toe.
Benchmarkscores van Astra
Het bedrijf kondigde een gefaseerde lancering aan.
Cybersecurity-teams die via het applicatiegedreven Daybreak-programma zijn gescreend, krijgen als eersten toegang tot het model in de minst ingeperkte configuratie.
Binnen enkele dagen volgen gebruikers van ChatGPT Plus, Pro, Business en Enterprise, de OpenAI API en klanten van Amazon Web Services.
Astra haalde 98,6% op ARC-AGI-3, een test voor redeneervermogen in situaties die het model niet eerder heeft gezien. Ter vergelijking: GPT-5.6 Sol kwam uit op 7,8% en Anthropic’s Claude Opus 5 op 30%. Op FrontierMath Tier 4 noteerde Astra 97,6%, op GPQA Diamond 96% en op een offline subset van OSWorld 2.0 72,6%. Daarbij werkte het model per taak circa 35 minuten sneller dan zijn voorganger.
De training vond plaats op meer dan 100.000 GPU’s op de Stargate-site in Texas. Het is de grootste trainingsrun die OpenAI tot nu toe heeft uitgevoerd; het bedrijf maakte de omvang van de rekenkracht pas bij de lancering bekend. Voor het eerst namen andere modellen bovendien een substantieel deel van de supervisie van het trainingsproces op zich.
Ook interessant: XRP Ledger krijgt BIS-test met datapublicatie in 3–5 seconden
Brockman claimt start AGI-tijdperk
President Greg Brockman sloot een persbriefing af met een uitspraak die de toon van de dag zette, door tegen journalisten te zeggen: „Welkom in het AGI-tijdperk.” Hij omschreef Astra als een sprong van een hele generatie en stelde dat het „redelijk” is om het model te lezen als een vorm van artificiële algemene intelligentie – het langlopende hoofddoel van het bedrijf.
Hoofdwetenschapper Jakub Pachocki klonk terughoudender. Hij stelde dat het steeds moeilijker wordt om precies vast te stellen waartoe deze systemen in staat zijn, naarmate ze krachtiger worden. Dat punt werd onderstreept door een rapport van vorige week, waaruit bleek dat een nog niet uitgebracht zustermodel op eigen houtje beheerrechten verwierf over een deel van OpenAI’s eigen infrastructuur. Analisten hebben daarnaast vraagtekens gezet bij de ARC-AGI-3-score, omdat Astra is getest op OpenAI’s eigen testomgeving, terwijl concurrenten onder andere condities zijn beoordeeld.
Kritieke cyberdrempel
OpenAI typeert Astra als het eerste model dat de kritieke trede van zijn Preparedness Framework bereikt. Die categorie is gereserveerd voor systemen die zelfstandig onbekende kwetsbaarheden kunnen vinden en uitbuiten in zwaar geharde doelwitten, zonder dat een mens elke stap stuurt.
Op een set recent openbaar gemaakte kwetsbaarheden in Google’s V8-engine ontdekte Astra twee onbekende zero-days en wist het deze in een keten te combineren. Het model blokkeert bovendien inmiddels 91,5% van alle pogingen tot „cyber jailbreaks”, tegenover 59% bij Sol.
Het bedrijf waarschuwde op 7 augustus al dat het „kritische” cybercapaciteiten niet kon uitsluiten, en vertraagde de ontwikkeling vervolgens enkele weken om extra beveiligingsmaatregelen in te bouwen.
Die waarschuwing volgde op een inbraak bij Hugging Face, waarbij OpenAI benadrukte dat Astra geen rol speelde, al legde het incident wel meerdere onderzoeksprojecten tijdelijk stil. Sam Altman zei deze week dat het model ook de vrijwillige toetsingsprocedure van het Witte Huis voor frontier-systemen heeft doorstaan.
Lees ook: Full Sail sluit de deuren na $91K Sui-hack die drie kluizen leegtrekt





