OpenAI's Astra-model zet kritieke cyberwaarschuwing uit na 10 doorbraken in de wiskunde

New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)
New security controls surround OpenAI Astra after tests point toward a possible Critical cyber threshold (Image: Shutterstock)

OpenAI waarschuwt dat Astra dicht bij het Kritieke niveau voor cyberbeveiliging kan komen, nadat een interne versie van het onuitgebrachte model tien belangrijke wiskundige resultaten opleverde én snelle vooruitgang liet zien in autonoom cyberwerk.

Kernpunten:

  • OpenAI meldde op 7 augustus dat het niet langer kan uitsluiten dat Astra Kritieke cyberbevoegdheden bereikt.
  • Het bedrijf heeft een deel van het interne Astra‑werk stilgelegd en scherpt beveiligingscontroles, sandboxes en monitoring aan.
  • Astra genereerde daarnaast tien onderzoeksresultaten die hardnekkige vraagstukken in de wiskunde en theoretische informatica oplosten of substantieel verder brachten.

Astra als cyberrisico

OpenAI verklaarde op 7 augustus dat recente interne evaluaties aantoonden dat Astra grote stappen zet in zogeheten “agentic” software­ontwikkeling en cybersecurity. De vooruitgang is volgens het bedrijf zodanig dat het niet langer kan uitsluiten dat het model het Kritieke niveau uit het eigen Preparedness Framework bereikt. OpenAI zegt niet dat Astra die drempel nu al haalt; de beoordeling is voorlopig.

In OpenAI’s raamwerk geldt een Kritiek model als een systeem dat autonoom werkende zero‑day‑exploits kan ontwikkelen tegen uiteenlopende, zwaar geharde kritieke systemen, of volledig nieuwe end‑to‑end aanvallen kan uitvoeren op basis van slechts een hoog‑niveau‑opdracht. OpenAI meldt daarom dat het netwerk- en tooltoegang aanscherpt, de bescherming van modelgewichten, versleuteling en sandboxing opvoert en de monitoring rond Astra’s agent‑achtige toepassingen uitbreidt.

Activiteiten met Astra die (nog) niet voldoen aan de strengere beveiligings­eisen zijn gepauzeerd. OpenAI zegt verder samen te gaan werken met overheidsinstanties en geselecteerde organisaties voor AI‑veiligheid om het model te testen. Het bedrijf omschreef Astra op 1 augustus als “ons volgende grote model” en sprak op 7 augustus van “een van onze aanstaande modellen”.

Ook interessant: Bitcoin nadert dit weekend een BIP-110‑fork met slechts 2,59% steun van miners

Discussie over de wiskunde-resultaten

De cyberwaarschuwing volgde op de onthulling van OpenAI dat een interne Astra‑variant tien resultaten opleverde in onder meer kwantumcomplexiteit, roostercryptografie, coderingstheorie en extremale combinatoriek. Volgens OpenAI loste het werk hardnekkige open problemen op of bracht het die aanzienlijk verder, tegen rekenkosten van circa 2.000 dollar aan tokens tegen Sol‑API‑tarieven.

Andrew Blumberg, hoogleraar aan Columbia University en bestuurslid van First Proof, zegt tegen Mashable dat de resultaten indrukwekkend zijn, maar zijn kijk op de huidige AI‑capaciteiten niet fundamenteel veranderen. Veel uitkomsten zijn volgens hem compacte tegenvoorbeelden of “kleine, extreem slimme constructies” die voortbouwen op bestaande literatuur. “Ze veranderen mijn priors niet,” aldus Blumberg.

Tegelijk laten de bevindingen zien hoe toonaangevende modellen steeds vaker als bruikbare onderzoeks­partner kunnen optreden – terwijl dezelfde programmeer­vaardigheden parallel een nieuw beveiligingsprobleem creëren als ze worden ingezet voor software‑exploits.

Die spanning bepaalt nu in toenemende mate hoe OpenAI aankijkt tegen toegang tot, en uitrol van, zijn modellen.

Voor Astra beoordeelde OpenAI de eerdere GPT‑5.6 Sol‑versie op het niveau Hoog in plaats van Kritiek. Dat model kon al helpen bij het opsporen en uitbuiten van kwetsbaarheden, maar slaagde er volgens OpenAI nog niet in om consequent volledig autonome aanvallen op geharde doelen uit te voeren. De nieuwe beoordeling van Astra markeert daarom een duidelijke escalatie.

Lees verder: Release­datum iPhone Fold wijst op 18 september, maar consensus ontbreekt

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev is de Head of Content bij Yellow.com en doet al 10 jaar verslag van crypto. Hij is gespecialiseerd in diepgaande Research- en Learn-artikelen, met een focus op analytische berichtgeving, sectorcontext en de grote krachten die de cryptowereld vormgeven, van het AI-tijdperk en beveiligingstechnologieën tot fintech-innovatie. Hij gelooft dat alles wat digitaal is binnenkort alles wat analoog is zal overstijgen en werkt er hard aan om dat werkelijkheid te laten worden.

Disclaimer en risicowaarschuwing: De informatie in dit artikel is uitsluitend voor educatieve en informatieve doeleinden en is gebaseerd op de mening van de auteur. Het vormt geen financieel, investerings-, juridisch of belastingadvies. Cryptocurrency-assets zijn zeer volatiel en onderhevig aan hoog risico, inclusief het risico om uw gehele of een substantieel deel van uw investering te verliezen. Het handelen in of aanhouden van crypto-assets is mogelijk niet geschikt voor alle beleggers. De meningen die in dit artikel worden geuit zijn uitsluitend die van de auteur(s) en vertegenwoordigen niet het officiële beleid of standpunt van Yellow, haar oprichters of haar leidinggevenden. Voer altijd uw eigen grondig onderzoek uit (D.Y.O.R.) en raadpleeg een gelicentieerde financiële professional voordat u een investeringsbeslissing neemt.
OpenAI's Astra-model zet kritieke cyberwaarschuwing uit na 10 doorbraken in de wiskunde | Yellow