OpenAI's Astra-model luidt kritieke cyberalarmbel na 10 grote doorbraken in de wiskunde

New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)
New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)

OpenAI waarschuwt dat Astra mogelijk dicht in de buurt komt van zijn Kritiek-drempel voor cyberbeveiliging. Het ongepubliceerde model leverde 10 grote wiskundige resultaten op en liet een snelle sprong zien in autonoom werk op het gebied van cyberveiligheid.

Kernpunten:

  • OpenAI verklaarde op 7 augustus dat het Kritieke cybercapaciteiten voor Astra niet langer kan uitsluiten.
  • Het bedrijf heeft een deel van het interne werk met Astra gepauzeerd en scherpt beveiligingscontroles, sandboxing en monitoring aan.
  • Astra genereerde ook tien onderzoeksresultaten die langdurige problemen in de wiskunde en de theoretische informatica oplosten of wezenlijk vooruitbrachten.

Cyberrisico rond Astra

OpenAI meldde op 7 augustus dat interne evaluaties aantoonden dat Astra fors is opgeschoven in zogeheten “agentic” softwareontwikkeling en cybersecurity. Die vooruitgang is volgens het bedrijf zó groot dat het niet langer kan uitsluiten dat Astra het niveau Kritiek bereikt binnen het eigen Preparedness Framework. OpenAI benadrukt dat het daarmee niet zegt dat het model deze drempel nu al daadwerkelijk haalt; de beoordeling is voorlopig.

In OpenAI’s raamwerk geldt een Kritiek-model als een systeem dat autonoom werkende zero-day-exploits kan ontwikkelen tegen uiteenlopende, zwaar beveiligde kritieke systemen, of volledig nieuwe end-to-end-aanvallen kan opzetten op basis van slechts een hoog-over doelstelling. OpenAI scherpt daarom netwerk- en tooltoegang aan, beschermt de modelgewichten strenger, breidt encryptie en sandboxing uit en intensiveert de monitoring van Astra’s inzet als “agent”.

Activiteiten met Astra die nog niet voldoen aan de aangescherpte eisen zijn gepauzeerd. OpenAI zegt samen te willen werken met overheidsinstanties en geselecteerde AI-veiligheidsorganisaties voor verdere tests. Op 1 augustus omschreef het bedrijf Astra nog als “ons volgende grote model”. Op 7 augustus sprak het over Astra als “een van onze aankomende modellen”.

Ook interessant: Bitcoin nadert dit weekend een BIP-110 fork met slechts 2,59% mijnerssteun

Discussie over de wiskunde

De cyberwaarschuwing volgde op OpenAI’s bekendmaking dat een interne versie van Astra tien resultaten opleverde in onder meer kwantumcomplexiteit, roostercryptografie, coding theory en extremale combinatoriek. Volgens OpenAI loste het werk langdurig openstaande problemen op, of duwde het die een flink stuk vooruit. De totale rekentijd kostte naar schatting zo’n 2.000 dollar aan tokens tegen Sol API-tarieven.

Andrew Blumberg, hoogleraar aan Columbia University en bestuurslid van First Proof, zei tegen Mashable dat de uitkomsten indrukwekkend zijn, maar zijn beeld van de huidige AI-capaciteiten niet veranderen. Veel resultaten zijn volgens hem beknopte tegenvoorbeelden of “kleine, extreem slimme constructies” die voortbouwen op bestaande literatuur. “Ze veranderen mijn priors niet,” aldus Blumberg.

Tegelijkertijd illustreren de resultaten hoe grensverleggende modellen zich kunnen ontwikkelen tot waardevolle onderzoekspartners, terwijl dezelfde programmeercapaciteiten parallel een nieuw beveiligingsrisico creëren wanneer ze worden ingezet voor software-exploitatie.

Die spanning vormt nu in toenemende mate de basis voor hoe OpenAI toegang tot en uitrol van zijn modellen beoordeelt.

Voor Astra beoordeelde OpenAI het model GPT-5.6 Sol nog op het niveau Hoog in plaats van Kritiek. Dat eerdere model kon al wel helpen bij het opsporen en uitbuiten van kwetsbaarheden, maar had volgens OpenAI geen betrouwbaar autonoom aanvalsgedrag laten zien tegen goed beveiligde doelen. Tegen die achtergrond geldt de nieuwste inschatting rond Astra als een duidelijke escalatie.

Lees ook: iPhone Fold releasedatum wijst op 18 september, maar de meningen lopen uiteen

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev is de Head of Content bij Yellow.com en doet al 10 jaar verslag van crypto. Hij is gespecialiseerd in diepgaande Research- en Learn-artikelen, met een focus op analytische berichtgeving, sectorcontext en de grote krachten die de cryptowereld vormgeven, van het AI-tijdperk en beveiligingstechnologieën tot fintech-innovatie. Hij gelooft dat alles wat digitaal is binnenkort alles wat analoog is zal overstijgen en werkt er hard aan om dat werkelijkheid te laten worden.

Disclaimer en risicowaarschuwing: De informatie in dit artikel is uitsluitend voor educatieve en informatieve doeleinden en is gebaseerd op de mening van de auteur. Het vormt geen financieel, investerings-, juridisch of belastingadvies. Cryptocurrency-assets zijn zeer volatiel en onderhevig aan hoog risico, inclusief het risico om uw gehele of een substantieel deel van uw investering te verliezen. Het handelen in of aanhouden van crypto-assets is mogelijk niet geschikt voor alle beleggers. De meningen die in dit artikel worden geuit zijn uitsluitend die van de auteur(s) en vertegenwoordigen niet het officiële beleid of standpunt van Yellow, haar oprichters of haar leidinggevenden. Voer altijd uw eigen grondig onderzoek uit (D.Y.O.R.) en raadpleeg een gelicentieerde financiële professional voordat u een investeringsbeslissing neemt.
OpenAI's Astra-model luidt kritieke cyberalarmbel na 10 grote doorbraken in de wiskunde | Yellow