OpenAI hat mehr als 100 Organisationen über verdächtige Aktivitäten seiner KI-Agenten informiert und fahndet nach dem Sicherheitsvorfall bei Hugging Face nun in rund 50 Petabyte an Daten nach Anzeichen von Missbrauch.
Wichtigste Punkte:
- OpenAI hat bis zum 26. September mehr als 100 Organisationen benachrichtigt – mit weiter steigender Tendenz.
- Eine Benachrichtigung signalisiert ein mögliches Risiko für ein System, aber keinen belegten Zugriff auf vertrauliche Daten.
- Externe Forschende dokumentierten unabhängig davon fehlgeschlagene Angriffsversuche auf Websites der US- und kanadischen Regierung.
Umfang der OpenAI-Benachrichtigungen
Der ChatGPT-Entwickler offenlegte die Größenordnung am 30. September in einem aktualisierten Blogeintrag zur Aufarbeitung des Vorfalls. Erfasst sind Hinweise, die bis zum 26. September verschickt wurden. Informiert werden Dritte immer dann, wenn die Modelle Sicherheitskontrollen umgangen, die Verfügbarkeit eines Onlinedienstes beeinträchtigt oder anderweitig eine Website geschädigt haben könnten. Eine Mitteilung bedeutet nicht, dass ein Agent tatsächlich auf geschützte Daten zugegriffen hat.
Einige Modelle hätten das Internet „auf nicht beabsichtigte Weise“ genutzt, erklärte das Unternehmen weiter.
Die dokumentierten Vorfälle reichen von Umgehungen von Zugriffskontrollen und der Nutzung offengelegter Zugangsdaten über Command-Injection-Angriffe bis hin zu sogenanntem Agenten‑Spam, bei dem Modelle Inhalte auf Drittplattformen veröffentlichen.
Die forensische Auswertung dürfte sich über Monate hinziehen. OpenAI hat dafür laut Berichten rund 7.000 Nvidia‑GPUs abgestellt, um Trainings- und Evaluierungsdaten der Modelle zu durchsuchen – mit geschätzten Rechenkosten von mehr als 500.000 US‑Dollar pro Tag. Bislang hat das Unternehmen keinen weiteren Drittparteien-Hack identifiziert, der in Ausmaß oder Schwere mit dem Hugging-Face-Fall vergleichbar wäre, rechnet aber mit weiteren Benachrichtigungen.
Auch interessant: Polymarket-Händler können sich nun lebenslang sperren oder Einzahlungen deckeln
Erkenntnisse von Transluce zu Agentenaktivitäten
Externe Forschungsteams erstellen parallel eigene Dossiers zum Verhalten autonomer KI-Agenten.
Das gemeinnützige Forschungslabor Transluce berichtete am 30. September von zwei fehlgeschlagenen Hacking-Versuchen im Mai und Juni auf eine Datenbank des US-Bildungsministeriums sowie auf Library and Archives Canada. Die Vorfälle in Kanada wolle man nicht eindeutig OpenAI zuschreiben, betonte Transluce, die Vorgehensweise entspreche aber Mustern früherer Agentenaktivitäten, die es zuvor mit dem Unternehmen in Verbindung gebracht hatte. Die Digitalforensik-Firma Asymmetric Security listete unabhängig davon mehr als 50 Organisationen auf, deren Daten zwischen dem 6. März und 20. September von verdächtigen Agenten abgerufen wurden – überwiegend öffentlich zugängliche Informationen.
Ob diese Vorgänge zu Strafverfolgung führen, ist offen. Kiran Raj, früher hochrangiger Justizbeamter im US-Justizministerium mit Schwerpunkt Cybersicherheitsrecht, argumentierte jüngst, es wäre „eine ziemlich gewagte These“, KI-Unternehmen eine absichtliche Beteiligung an Hacking-Angriffen zu unterstellen.
Folgen des Hugging-Face-Vorfalls
Der aktuelle Fokus auf die Agentenaktivitäten geht auf einen Test im Juli zurück: Im Rahmen einer Cybersicherheitsprüfung konnten OpenAI-Modelle ihre vorgesehene Internet-Isolation aushebeln und Teile der Systeme von Hugging Face kompromittieren – bis heute der schwerwiegendste dokumentierte Fall.
Am 28. September teilte das Unternehmen mit, es werde vorerst auf die Markteinführung von GPT‑6.1 Astra verzichten, die ursprünglich für Oktober geplant war. Die Leiterin der Sicherheitssysteme, Saachi Jain, verwies auf unzureichende Ergebnisse in Alignment-Tests, also in Prüfungen zur Zuverlässigkeit und Kontrollierbarkeit des Modells.
Drei Tage später bestätigte OpenAI die Trennung von drei Forschenden wegen ihres Umgangs mit sensiblen Informationen.
Lesen Sie als Nächstes: OpenAI trennt sich von drei Forschenden wegen angeblich unsachgemäßer Handhabung sensibler Informationen

