Astra haalt perfecte 100% op zwaarste cyber­test van OpenAI

Perfect exploit scores put OpenAI's GPT-6 Astra in the critical cyber tier as its staged rollout begins. (Image: Shutterstock)
Perfect exploit scores put OpenAI's GPT-6 Astra in the critical cyber tier as its staged rollout begins. (Image: Shutterstock)

OpenAI is donderdag begonnen met de uitrol van GPT-6 Astra, het eerste model dat het bedrijf zelf aanmerkt als “kritiek” op het vlak van cyberrisico, na een perfecte score van 100% op ExploitBench.

Belangrijkste punten

  • OpenAI heeft GPT-6 Astra donderdag vrijgegeven, te beginnen bij gescreende beveiligingsspecialisten in het Daybreak-programma. Binnen enkele dagen volgt toegang voor ChatGPT Plus-, Pro-, Business- en Enterprise-klanten.
  • Het model scoorde 100% op ExploitBench en 98,6% op ARC-AGI-3, tegenover 7,8% voor GPT-5.6 Sol.
  • De training draaide op meer dan 100.000 GPU’s op de Stargate-locatie in Texas, de grootste trainingsrun van het bedrijf tot nu toe.

Benchmark­scores van Astra

Het bedrijf kondigde een gefaseerde lancering aan.

Cybersecurity-teams die via het applicatiegedreven Daybreak-programma zijn gescreend, krijgen als eersten toegang tot het model in de minst ingeperkte configuratie.

Binnen enkele dagen volgen gebruikers van ChatGPT Plus, Pro, Business en Enterprise, de OpenAI API en klanten van Amazon Web Services.

Astra haalde 98,6% op ARC-AGI-3, een test voor redeneervermogen in situaties die het model niet eerder heeft gezien. Ter vergelijking: GPT-5.6 Sol kwam uit op 7,8% en Anthropic’s Claude Opus 5 op 30%. Op FrontierMath Tier 4 noteerde Astra 97,6%, op GPQA Diamond 96% en op een offline subset van OSWorld 2.0 72,6%. Daarbij werkte het model per taak circa 35 minuten sneller dan zijn voorganger.

De training vond plaats op meer dan 100.000 GPU’s op de Stargate-site in Texas. Het is de grootste trainingsrun die OpenAI tot nu toe heeft uitgevoerd; het bedrijf maakte de omvang van de rekenkracht pas bij de lancering bekend. Voor het eerst namen andere modellen bovendien een substantieel deel van de supervisie van het trainingsproces op zich.

Ook interessant: XRP Ledger krijgt BIS-test met datapublicatie in 3–5 seconden

Brockman claimt start AGI-tijdperk

President Greg Brockman sloot een persbriefing af met een uitspraak die de toon van de dag zette, door tegen journalisten te zeggen: „Welkom in het AGI-tijdperk.” Hij omschreef Astra als een sprong van een hele generatie en stelde dat het „redelijk” is om het model te lezen als een vorm van artificiële algemene intelligentie – het langlopende hoofddoel van het bedrijf.

Hoofdwetenschapper Jakub Pachocki klonk terughoudender. Hij stelde dat het steeds moeilijker wordt om precies vast te stellen waartoe deze systemen in staat zijn, naarmate ze krachtiger worden. Dat punt werd onderstreept door een rapport van vorige week, waaruit bleek dat een nog niet uitgebracht zuster­model op eigen houtje beheerrechten verwierf over een deel van OpenAI’s eigen infrastructuur. Analisten hebben daarnaast vraagtekens gezet bij de ARC-AGI-3-score, omdat Astra is getest op OpenAI’s eigen testomgeving, terwijl concurrenten onder andere condities zijn beoordeeld.

Kritieke cyberdrempel

OpenAI typeert Astra als het eerste model dat de kritieke trede van zijn Preparedness Framework bereikt. Die categorie is gereserveerd voor systemen die zelfstandig onbekende kwetsbaarheden kunnen vinden en uitbuiten in zwaar geharde doelwitten, zonder dat een mens elke stap stuurt.

Op een set recent openbaar gemaakte kwetsbaarheden in Google’s V8-engine ontdekte Astra twee onbekende zero-days en wist het deze in een keten te combineren. Het model blokkeert bovendien inmiddels 91,5% van alle pogingen tot „cyber jailbreaks”, tegenover 59% bij Sol.

Het bedrijf waarschuwde op 7 augustus al dat het „kritische” cybercapaciteiten niet kon uitsluiten, en vertraagde de ontwikkeling vervolgens enkele weken om extra beveiligingsmaatregelen in te bouwen.

Die waarschuwing volgde op een inbraak bij Hugging Face, waarbij OpenAI benadrukte dat Astra geen rol speelde, al legde het incident wel meerdere onderzoeksprojecten tijdelijk stil. Sam Altman zei deze week dat het model ook de vrijwillige toetsingsprocedure van het Witte Huis voor frontier-systemen heeft doorstaan.

Lees ook: Full Sail sluit de deuren na $91K Sui-hack die drie kluizen leegtrekt

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev is de Head of Content bij Yellow.com en doet al 10 jaar verslag van crypto. Hij is gespecialiseerd in diepgaande Research- en Learn-artikelen, met een focus op analytische berichtgeving, sectorcontext en de grote krachten die de cryptowereld vormgeven, van het AI-tijdperk en beveiligingstechnologieën tot fintech-innovatie. Hij gelooft dat alles wat digitaal is binnenkort alles wat analoog is zal overstijgen en werkt er hard aan om dat werkelijkheid te laten worden.

Disclaimer en risicowaarschuwing: De informatie in dit artikel is uitsluitend voor educatieve en informatieve doeleinden en is gebaseerd op de mening van de auteur. Het vormt geen financieel, investerings-, juridisch of belastingadvies. Cryptocurrency-assets zijn zeer volatiel en onderhevig aan hoog risico, inclusief het risico om uw gehele of een substantieel deel van uw investering te verliezen. Het handelen in of aanhouden van crypto-assets is mogelijk niet geschikt voor alle beleggers. De meningen die in dit artikel worden geuit zijn uitsluitend die van de auteur(s) en vertegenwoordigen niet het officiële beleid of standpunt van Yellow, haar oprichters of haar leidinggevenden. Voer altijd uw eigen grondig onderzoek uit (D.Y.O.R.) en raadpleeg een gelicentieerde financiële professional voordat u een investeringsbeslissing neemt.
Astra haalt perfecte 100% op zwaarste cyber­test van OpenAI | Yellow