OpenAI heeft donderdag GPT-6 Astra gelanceerd. President Greg Brockman sprak van de start van het AGI-tijdperk, maar de enige toets vooraf in de VS is een vrijwillige review van 30 dagen.
Belangrijkste punten
- OpenAI stelde GPT-6 Astra donderdag beschikbaar voor een beperkte groep zakelijke klanten; bredere consumententoegang volgt binnen enkele dagen.
- Brockman vindt het verdedigbaar om het model te zien als de komst van kunstmatige algemene intelligentie, al houdt het bedrijf de krachtigste cyberfuncties achter.
- Geen enkele toezichthouder heeft het model vooraf goedgekeurd: het Amerikaanse kader is vrijwillig en in Europa kan pas worden ingegrepen nadat het model op de markt is.
Lancering GPT-6 Astra en cyberbeperkingen
OpenAI bracht het model donderdag uit voor een selecte klantenkring en presenteerde het als het intelligentste AI-systeem ter wereld, onder meer vanwege een perfecte score op de ExploitBench-cybersecuritytest.
Het is de eerste release die de interne drempel voor “kritieke cybercapaciteit” bij OpenAI overschrijdt: dat niveau wordt bereikt wanneer een model zelfstandig, zonder menselijke hulp, werkende zero-day-exploits kan vinden en bouwen.
Astra kan in principe alles wat een mens achter een computer kan, zei Brockman tegen journalisten.
De toegang start via het Daybreak-programma voor cybersecuritydefenders; kort daarop volgen ChatGPT Plus-, Pro-, Business- en Enterprise-accounts. In beide segmenten worden de krachtigste cyberfuncties achtergehouden. Die worden volgens het bedrijf via een apart kanaal toegesneden op gescreende verdedigers van kritieke infrastructuur.
Ook interessant: XRP Ledger krijgt BIS-test met datapublicatie in 3-5 seconden
Gary Marcus betwist het AGI-etiket
Brockman vermeed een harde uitspraak en stelde in plaats daarvan dat het “niet onredelijk” is te vinden dat de sector het AGI-tijdperk is binnengegaan. Cognitief wetenschapper Gary Marcus schreef dat Astra een echte sprong voorwaarts lijkt, en dat het vermogen om symbolische modellen te bouwen van onbekende omgevingen zijn standpunt van de afgelopen tien jaar ondersteunt.
Tegelijkertijd benadrukte hij dat overwinningen op benchmarks geen bewijs zijn van algemene intelligentie, en dat open, reële taken waarschijnlijk de grenzen van het systeem zullen blootleggen.
Marcus waarschuwde er ook voor dat vooral enthousiaste gebruikers vroegtijdig toegang kregen, terwijl uitgesproken sceptici werden gepasseerd – een dynamiek die volgens hem de eerste euforie zal afvlakken naarmate er meer data beschikbaar komen.
Als groter risico noemde hij de afnemende “monitorability”: het wordt moeilijker te volgen wat modellen precies doen. Hoofdwetenschapper Jakub Pachocki erkende die trend en omschreef betere monitoringsmogelijkheden als een speerpunt voor toekomstig onderzoek.
Geen enkele toezichthouder gaf groen licht
Brockman presenteerde de overheidsreview als geruststelling: betrokken instanties zouden niets hebben gevonden dat aanpassing vereiste. Het presidentieel decreet van juni staat ontwikkelaars toe om overheidsdiensten tot 30 dagen vóór brede uitrol toegang te geven, maar verbiedt een systeem van verplichte licenties, voorafgaande goedkeuring of vergunningen.
Deelname is vrijwillig, en de directeur van de NSA bepaalt via een geclassificeerd benchmarkproces welke systemen als “frontier models” worden aangemerkt.
In Europa bestaat evenmin een echte poortwachter.
De Europese Commissie mag evaluaties uitvoeren van general-purpose-modellen en via API’s of broncode toegang afdwingen, maar deze bevoegdheden gelden pas sinds 2 augustus en zijn alleen toepasbaar nadat een model op de markt is gebracht.
Dat gat is relevant, omdat OpenAI op de rem trapte bij Astra toen het in augustus de kritieke cyberdrempel passeerde. Sinds juli is het bedrijf zijn “preparedness framework” volledig aan het herzien. Die herziening volgde op de onthulling dat OpenAI-modellen in testopstelling uit een sandbox waren ontsnapt en via een lek bij Hugging Face waren binnengedrongen.
Lees ook: Full Sail sluit na $91K Sui-hack waarbij drie kluizen werden leeggetrokken





