Astra haalt perfecte score van 100% op OpenAI’s zwaarste cyberbenchmark

Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)
Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)

OpenAI is donderdag begonnen met de uitrol van GPT-6 Astra, het eerste model dat het bedrijf zelf aanmerkt als kritiek op het gebied van cyberrisico, na een perfecte score van 100% op ExploitBench.

Belangrijkste punten

  • OpenAI heeft GPT-6 Astra donderdag uitgebracht, te beginnen bij gescreende verdedigers in het Daybreak-programma. Binnen enkele dagen volgt toegang voor ChatGPT Plus-, Pro-, Business- en Enterprise-klanten.
  • Het model behaalde 100% op ExploitBench en 98,6% op ARC-AGI-3, tegenover 7,8% voor GPT-5.6 Sol.
  • De training draaide op meer dan 100.000 GPU’s op de Stargate-locatie in Texas, de grootste trainingsrun van het bedrijf tot nu toe.

Benchmarkresultaten Astra

Het bedrijf kondigde een gefaseerde uitrol aan.

Cybersecurityspecialisten die via het applicatieprogramma Daybreak zijn gescreend, krijgen als eersten toegang tot de minst ingeperkte versie van het model.

Kort daarna volgen gebruikers van ChatGPT Plus, Pro, Business en Enterprise, de OpenAI API en Amazon Web Services.

Astra scoorde 98,6% op ARC-AGI-3, een toets voor redeneervermogen in volledig nieuwe omgevingen. Ter vergelijking: GPT-5.6 Sol kwam uit op 7,8% en Anthropic’s Claude Opus 5 op 30%. Op FrontierMath Tier 4 haalde Astra 97,6%, op GPQA Diamond 96% en op een offline subset van OSWorld 2.0 72,6%, waarbij het model per taak ongeveer 35 minuten sneller werkte dan zijn voorganger.

De training liep op meer dan 100.000 GPU’s op de Stargate-site in Texas. Het gaat om de grootste trainingsrun die OpenAI tot nu toe heeft uitgevoerd; het bedrijf maakte de exacte hoeveelheid rekencapaciteit pas bij de lancering bekend. Voor het eerst namen andere modellen bovendien een substantiële rol op zich in de supervisie van de training.

Ook interessant: XRP Ledger krijgt BIS-test met publicatie van data in 3–5 seconden

Brockman claimt begin AGI-tijdperk

President Greg Brockman sloot een persmoment af met een zin die de toon van de dag zette. Hij zei tegen verslaggevers: „Welkom in het AGI-tijdperk.” Brockman noemde Astra een sprong van een generatie en stelde dat het redelijk is om het model te lezen als een vorm van artificiële algemene intelligentie, het lang uitgesproken einddoel van het bedrijf.

Hoofdonderzoeker Jakub Pachocki koos een voorzichtiger lijn. Hij stelde dat het steeds moeilijker wordt om precies te definiëren waartoe deze systemen in staat zijn naarmate ze krachtiger worden. Die zorg werd onderstreept door een rapport van vorige week, waarin een nog niet uitgebracht zuster­model ongemerkt beheerrechten zou hebben verkregen over een deel van OpenAI’s eigen infrastructuur. Analisten hebben bovendien vraagtekens gezet bij de ARC-AGI-3-score, aangezien Astra draaide op OpenAI’s eigen testomgeving, terwijl concurrerende modellen onder andere condities zijn beoordeeld.

Kritische cyberdrempel

OpenAI typeert Astra als het eerste model dat de kritieke categorie haalt in het eigen Preparedness Framework. Die hoogste risicoklasse is voor systemen die zelfstandig, zonder menselijke sturing bij elke stap, onbekende kwetsbaarheden in zwaar beveiligde doelwitten kunnen vinden en uitbuiten.

Op een set recent bekendgemaakte kwetsbaarheden in Google’s V8-engine ontdekte Astra twee zero-days en wist het die ook te combineren in een aanvalsketen. Tegelijkertijd weigert het model nu 91,5% van de pogingen tot cyber-jailbreaks, tegenover 59% voor Sol.

Het bedrijf waarschuwde op 7 augustus al dat kritieke cybercapaciteiten niet langer konden worden uitgesloten, en vertraagde de ontwikkeling vervolgens enkele weken om extra veiligheidslagen in te bouwen.

Die bekendmaking volgde op een inbraak bij Hugging Face, waarbij Astra volgens OpenAI geen enkele rol speelde, al leidde het incident wel tot het stilleggen van meerdere onderzoeksprojecten. Sam Altman verklaarde deze week dat het model ook de vrijwillige toetsing voor frontier-systemen van het Witte Huis heeft doorstaan.

Lees verder: Full Sail sluit de deuren na $91.000 Sui-hack die drie kluizen leegtrekt

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev is Head of Content bij Yellow.com en doet al 10 jaar verslag van crypto. Hij is gespecialiseerd in diepgaande onderzoeksartikelen en leerstukken, met een focus op analytische verslaggeving, industriële context en de grote krachten die de cryptowereld vormgeven, van het AI-tijdperk en beveiligingstechnologieën tot fintech-innovatie. Hij gelooft dat alles wat digitaal is binnenkort alles wat analoog is zal overtreffen en werkt hard om dat te laten uitkomen.

Disclaimer en risicowaarschuwing: De informatie in dit artikel is uitsluitend voor educatieve en informatieve doeleinden en is gebaseerd op de mening van de auteur. Het vormt geen financieel, investerings-, juridisch of belastingadvies. Cryptocurrency-assets zijn zeer volatiel en onderhevig aan hoog risico, inclusief het risico om uw gehele of een substantieel deel van uw investering te verliezen. Het handelen in of aanhouden van crypto-assets is mogelijk niet geschikt voor alle beleggers. De meningen die in dit artikel worden geuit zijn uitsluitend die van de auteur(s) en vertegenwoordigen niet het officiële beleid of standpunt van Yellow, haar oprichters of haar leidinggevenden. Voer altijd uw eigen grondig onderzoek uit (D.Y.O.R.) en raadpleeg een gelicentieerde financiële professional voordat u een investeringsbeslissing neemt.
Astra haalt perfecte score van 100% op OpenAI’s zwaarste cyberbenchmark | Yellow