OpenAI waarschuwt dat Astra mogelijk dicht in de buurt komt van zijn Kritiek-drempel voor cyberbeveiliging. Het ongepubliceerde model leverde 10 grote wiskundige resultaten op en liet een snelle sprong zien in autonoom werk op het gebied van cyberveiligheid.
Kernpunten:
- OpenAI verklaarde op 7 augustus dat het Kritieke cybercapaciteiten voor Astra niet langer kan uitsluiten.
- Het bedrijf heeft een deel van het interne werk met Astra gepauzeerd en scherpt beveiligingscontroles, sandboxing en monitoring aan.
- Astra genereerde ook tien onderzoeksresultaten die langdurige problemen in de wiskunde en de theoretische informatica oplosten of wezenlijk vooruitbrachten.
Cyberrisico rond Astra
OpenAI meldde op 7 augustus dat interne evaluaties aantoonden dat Astra fors is opgeschoven in zogeheten “agentic” softwareontwikkeling en cybersecurity. Die vooruitgang is volgens het bedrijf zó groot dat het niet langer kan uitsluiten dat Astra het niveau Kritiek bereikt binnen het eigen Preparedness Framework. OpenAI benadrukt dat het daarmee niet zegt dat het model deze drempel nu al daadwerkelijk haalt; de beoordeling is voorlopig.
In OpenAI’s raamwerk geldt een Kritiek-model als een systeem dat autonoom werkende zero-day-exploits kan ontwikkelen tegen uiteenlopende, zwaar beveiligde kritieke systemen, of volledig nieuwe end-to-end-aanvallen kan opzetten op basis van slechts een hoog-over doelstelling. OpenAI scherpt daarom netwerk- en tooltoegang aan, beschermt de modelgewichten strenger, breidt encryptie en sandboxing uit en intensiveert de monitoring van Astra’s inzet als “agent”.
Activiteiten met Astra die nog niet voldoen aan de aangescherpte eisen zijn gepauzeerd. OpenAI zegt samen te willen werken met overheidsinstanties en geselecteerde AI-veiligheidsorganisaties voor verdere tests. Op 1 augustus omschreef het bedrijf Astra nog als “ons volgende grote model”. Op 7 augustus sprak het over Astra als “een van onze aankomende modellen”.
Ook interessant: Bitcoin nadert dit weekend een BIP-110 fork met slechts 2,59% mijnerssteun
Discussie over de wiskunde
De cyberwaarschuwing volgde op OpenAI’s bekendmaking dat een interne versie van Astra tien resultaten opleverde in onder meer kwantumcomplexiteit, roostercryptografie, coding theory en extremale combinatoriek. Volgens OpenAI loste het werk langdurig openstaande problemen op, of duwde het die een flink stuk vooruit. De totale rekentijd kostte naar schatting zo’n 2.000 dollar aan tokens tegen Sol API-tarieven.
Andrew Blumberg, hoogleraar aan Columbia University en bestuurslid van First Proof, zei tegen Mashable dat de uitkomsten indrukwekkend zijn, maar zijn beeld van de huidige AI-capaciteiten niet veranderen. Veel resultaten zijn volgens hem beknopte tegenvoorbeelden of “kleine, extreem slimme constructies” die voortbouwen op bestaande literatuur. “Ze veranderen mijn priors niet,” aldus Blumberg.
Tegelijkertijd illustreren de resultaten hoe grensverleggende modellen zich kunnen ontwikkelen tot waardevolle onderzoekspartners, terwijl dezelfde programmeercapaciteiten parallel een nieuw beveiligingsrisico creëren wanneer ze worden ingezet voor software-exploitatie.
Die spanning vormt nu in toenemende mate de basis voor hoe OpenAI toegang tot en uitrol van zijn modellen beoordeelt.
Voor Astra beoordeelde OpenAI het model GPT-5.6 Sol nog op het niveau Hoog in plaats van Kritiek. Dat eerdere model kon al wel helpen bij het opsporen en uitbuiten van kwetsbaarheden, maar had volgens OpenAI geen betrouwbaar autonoom aanvalsgedrag laten zien tegen goed beveiligde doelen. Tegen die achtergrond geldt de nieuwste inschatting rond Astra als een duidelijke escalatie.
Lees ook: iPhone Fold releasedatum wijst op 18 september, maar de meningen lopen uiteen





