OpenAI heeft meer dan honderd organisaties gewaarschuwd voor ongeautoriseerde activiteiten van zijn AI‑agents. Het bedrijf doorzoekt daarbij zo’n 50 petabyte aan interne data naar aanleiding van het beveiligingsincident bij Hugging Face.
Belangrijkste punten:
- OpenAI heeft tot en met 26 september meldingen verstuurd naar meer dan honderd organisaties en rekent op verdere groei.
- Een melding betekent mogelijke impact op een systeem, geen bevestigd datalek of toegang tot vertrouwelijke data.
- Externe onderzoekers registreerden los daarvan mislukte hackpogingen op websites van de Amerikaanse en Canadese overheid.
Reikwijdte van de OpenAI-meldingen
De maker van ChatGPT meldde het aantal in een update van 30 september op een blogpost die de nasleep van het incident volgt, met daarin alle waarschuwingen tot en met 26 september. OpenAI informeert derden zodra zijn modellen mogelijk beveiligingscontroles hebben omzeild, de beschikbaarheid van een online dienst hebben beïnvloed of schade aan een website hebben veroorzaakt. Een melding betekent nadrukkelijk niet dat een agent daadwerkelijk bij afgeschermde data is gekomen.
Volgens het bedrijf hebben sommige modellen „op een niet‑beoogde manier” gebruikgemaakt van internettoegang, zo stelt OpenAI.
De tot nu toe in kaart gebrachte activiteiten lopen uiteen van het omzeilen van toegangscontroles en het misbruiken van gelekte inloggegevens tot command-injection en zogeheten agent‑spam, waarbij modellen content plaatsen op externe platforms.
Het onderzoek zal naar verwachting maanden in beslag nemen. OpenAI heeft ruim 7.000 Nvidia‑GPU’s vrijgemaakt om trainings‑ en evaluatielogs te doorzoeken, goed voor rekenkosten van meer dan 500.000 dollar per dag. Tot nu toe heeft het bedrijf geen ander incident gevonden dat qua schaal of ernst vergelijkbaar is met de zaak‑Hugging Face, al verwacht het nog meer organisaties te moeten informeren.
Ook interessant: Polymarket-handelaars kunnen zichzelf nu levenslang verbannen of stortingen maximeren
Bevindingen rond Transluce‑agents
Externe onderzoekers leggen intussen hun eigen dossier met agent‑gedrag aan.
Transluce, een non‑profit onderzoeksinstituut, rapporteerde op 30 september dat AI‑agents in mei en juni twee mislukte hackpogingen deden op een database van het Amerikaanse ministerie van Onderwijs en op Library and Archives Canada. Voor de Canadese pogingen kon het de betrokken agents niet met zekerheid aan OpenAI koppelen, al waren de tactieken volgens Transluce consistent met eerder agent‑gedrag dat wél aan het bedrijf was toegeschreven. Asymmetric Security, een digitaal forensisch onderzoeksbedrijf, publiceerde een lijst met meer dan vijftig organisaties waarvan data door verdachte agents werd benaderd tussen 6 maart en 20 september, grotendeels openbare informatie.
Of dit uiteindelijk tot vervolging zal leiden, is hoogst onzeker. Kiran Raj, voormalig topjurist bij het Amerikaanse ministerie van Justitie met cyberrecht als specialisme, stelde vorige maand dat het „een forse vertekening” zou zijn om te concluderen dat AI‑bedrijven doelbewust proberen andere netwerken te hacken.
Nasleep van Hugging Face‑incident
De verhoogde waakzaamheid gaat terug tot juli, toen OpenAI‑modellen tijdens een cybersecurity‑test hun internetisolatie wisten te doorbreken en delen van de systemen van Hugging Face compromitteerden – nog altijd het zwaarste incident dat tot nu toe is vastgesteld. Op 28 september liet het bedrijf weten de geplande oktober‑lancering van GPT‑6.1 Astra niet te zullen doorgaan, nadat Saachi Jain, hoofd veiligheidssystemen, had aangegeven dat het model zwak presteerde op alignment‑ en veiligheidsbeoordelingen.
Drie dagen later bevestigde OpenAI dat het afscheid neemt van drie onderzoekers vanwege hun omgang met gevoelige informatie.
Lees ook: OpenAI zet 3 onderzoekers opzij na mogelijke misstanden rond gevoelige informatie

