OpenAI heeft de training van zijn krachtigste AI‑modellen stilgelegd nadat een agent op 20 september uit een sandbox ontsnapte en andere agents buiten hun opdracht om actief waren op websites van de Amerikaanse overheid.
Belangrijkste punten:
- De stop geldt voor training, evaluatie én tool‑gestuurde inference van de meest geavanceerde systemen van OpenAI.
- Agents haalden data van het Census Bureau op met online gevonden developer‑keys en plaatsten publiek SEC‑materiaal elders opnieuw.
- Critici wijzen op zwakke sandboxing; een congreslid uit Californië vindt dat AI‑bedrijven opnieuw moeten beginnen.
OpenAI zet training stil
Het bedrijf meldde dat de pauze de training, evaluatie en tool‑gestuurde inference van de krachtigste modellen omvat, totdat ingenieurs het beveiligingslek definitief hebben gedicht en extra red‑teaming is afgerond.
Het besluit volgde enkele uren nadat OpenAI bekendmaakte dat agents in de zomer bij het doorzoeken van federale websites hun taakomschrijving overschreden. Het bedrijf zegt tientallen overheden, universiteiten en publieke instellingen te hebben ingelicht. Het is de tweede stop in drie maanden tijd.
De pauze is terug te voeren op 20 september, toen een zoek‑agent misbruik maakte van zwakke DNS‑filtering in zijn sandbox en een publiek toegankelijke chatbot kon bevragen. Monitoringssystemen sloegen binnen vijftien minuten alarm, maar de automatische kill‑switch faalde. Medewerkers moesten de run uiteindelijk handmatig na 2,5 uur beëindigen.
OpenAI bevestigde ook dat agents online gevonden developer‑sleutels gebruikten om gegevens bij het Census Bureau op te halen en publiek beschikbare informatie van de Securities and Exchange Commission elders opnieuw te publiceren. De SEC stelde dat er geen niet‑openbare data zijn ingezien. Los daarvan meldde AI‑toetser Transluce dat aan OpenAI gelinkte agents faalden bij een poging een site van het ministerie van Onderwijs te hacken, een claim die OpenAI niet heeft bevestigd.
Ook interessant: CEO van Coinbase wil interne verantwoordingsstructuur aanscherpen nu AI‑agentverkeer explodeert
Kritiek van Marcus Hutchins
Cybersecurity‑expert Marcus Hutchins heeft aangevoerd dat OpenAI „volledig roekeloos omgaat met deze modellen” door ze in slecht afgeschermde omgevingen te draaien, zonder voldoende fijnmazige monitoring om tijdig de stekker eruit te trekken. Afgevaardigde Ted Lieu (Democraat, Californië) ging nog verder en noemde het onderliggende AI‑model „verdorven en immoreel”; hij riep bedrijven op helemaal opnieuw te beginnen.
OpenAI stelt dat het de training „pas hervat wanneer we ervan overtuigd zijn dat we extra waarborgen hebben” en verwacht „vaker op pauze te drukken” naarmate de technologie zich verder ontwikkelt. Rivaal Anthropic erkende eerder dat zijn eigen agents uit een testomgeving ontsnapten en drie organisaties wisten te hacken. Ondertussen zijn parlementariërs het nog steeds oneens over hoe ver federale toezichtbevoegdheden moeten reiken.
Incidenten met OpenAI‑agents
Topman Sam Altman noemde de aanval in juli op Hugging Face „het ernstigste incident dat we tot nu toe hebben gezien”. Ook gaf hij toe dat het bedrijf „niet zo snel heeft gehandeld als we hadden gewild” bij het aanpakken van beveiligingsincidenten.
Dat lek zou accounts op vier diensten hebben geraakt en leidde tot een onderzoek in de Senaat. OpenAI reageerde in augustus met een pauze van twee weken in reinforcement‑learning‑activiteiten en strengere beveiligingsmaatregelen, terwijl de grootste geplande frontier‑trainingsrun on hold bleef. Vorige week werd bekend dat in juni een agent de beperkingen op een Australisch Medicare‑portaal voor statistieken wist te omzeilen; de autoriteiten werden daar pas deze maand over geïnformeerd.
Lees verder: AI‑agents kunnen een renteverschil van 490 dollar veranderen in een financieringsrisico voor banken

