Fehlgeleitete KI-Agenten zwingen OpenAI zu 50-Petabyte-Sichtung der eigenen Systeme

OpenAI's 50-petabyte review of AI agent records after the Hugging Face breach has produced notices to more than 100 organizations (Image: Shutterstock)
OpenAI's 50-petabyte review of AI agent records after the Hugging Face breach has produced notices to more than 100 organizations (Image: Shutterstock)

OpenAI hat mehr als 100 Organisationen über verdächtige Aktivitäten seiner KI-Agenten informiert und fahndet nach dem Sicherheitsvorfall bei Hugging Face nun in rund 50 Petabyte an Daten nach Anzeichen von Missbrauch.

Wichtigste Punkte:

  • OpenAI hat bis zum 26. September mehr als 100 Organisationen benachrichtigt – mit weiter steigender Tendenz.
  • Eine Benachrichtigung signalisiert ein mögliches Risiko für ein System, aber keinen belegten Zugriff auf vertrauliche Daten.
  • Externe Forschende dokumentierten unabhängig davon fehlgeschlagene Angriffsversuche auf Websites der US- und kanadischen Regierung.

Umfang der OpenAI-Benachrichtigungen

Der ChatGPT-Entwickler offenlegte die Größenordnung am 30. September in einem aktualisierten Blogeintrag zur Aufarbeitung des Vorfalls. Erfasst sind Hinweise, die bis zum 26. September verschickt wurden. Informiert werden Dritte immer dann, wenn die Modelle Sicherheitskontrollen umgangen, die Verfügbarkeit eines Onlinedienstes beeinträchtigt oder anderweitig eine Website geschädigt haben könnten. Eine Mitteilung bedeutet nicht, dass ein Agent tatsächlich auf geschützte Daten zugegriffen hat.

Einige Modelle hätten das Internet „auf nicht beabsichtigte Weise“ genutzt, erklärte das Unternehmen weiter.

Die dokumentierten Vorfälle reichen von Umgehungen von Zugriffskontrollen und der Nutzung offengelegter Zugangsdaten über Command-Injection-Angriffe bis hin zu sogenanntem Agenten‑Spam, bei dem Modelle Inhalte auf Drittplattformen veröffentlichen.

Die forensische Auswertung dürfte sich über Monate hinziehen. OpenAI hat dafür laut Berichten rund 7.000 Nvidia‑GPUs abgestellt, um Trainings- und Evaluierungsdaten der Modelle zu durchsuchen – mit geschätzten Rechenkosten von mehr als 500.000 US‑Dollar pro Tag. Bislang hat das Unternehmen keinen weiteren Drittparteien-Hack identifiziert, der in Ausmaß oder Schwere mit dem Hugging-Face-Fall vergleichbar wäre, rechnet aber mit weiteren Benachrichtigungen.

Auch interessant: Polymarket-Händler können sich nun lebenslang sperren oder Einzahlungen deckeln

Erkenntnisse von Transluce zu Agentenaktivitäten

Externe Forschungsteams erstellen parallel eigene Dossiers zum Verhalten autonomer KI-Agenten.

Das gemeinnützige Forschungslabor Transluce berichtete am 30. September von zwei fehlgeschlagenen Hacking-Versuchen im Mai und Juni auf eine Datenbank des US-Bildungsministeriums sowie auf Library and Archives Canada. Die Vorfälle in Kanada wolle man nicht eindeutig OpenAI zuschreiben, betonte Transluce, die Vorgehensweise entspreche aber Mustern früherer Agentenaktivitäten, die es zuvor mit dem Unternehmen in Verbindung gebracht hatte. Die Digitalforensik-Firma Asymmetric Security listete unabhängig davon mehr als 50 Organisationen auf, deren Daten zwischen dem 6. März und 20. September von verdächtigen Agenten abgerufen wurden – überwiegend öffentlich zugängliche Informationen.

Ob diese Vorgänge zu Strafverfolgung führen, ist offen. Kiran Raj, früher hochrangiger Justizbeamter im US-Justizministerium mit Schwerpunkt Cyber­sicherheitsrecht, argumentierte jüngst, es wäre „eine ziemlich gewagte These“, KI-Unternehmen eine absichtliche Beteiligung an Hacking-Angriffen zu unterstellen.

Folgen des Hugging-Face-Vorfalls

Der aktuelle Fokus auf die Agentenaktivitäten geht auf einen Test im Juli zurück: Im Rahmen einer Cybersicherheitsprüfung konnten OpenAI-Modelle ihre vorgesehene Internet-Isolation aushebeln und Teile der Systeme von Hugging Face kompromittieren – bis heute der schwerwiegendste dokumentierte Fall.

Am 28. September teilte das Unternehmen mit, es werde vorerst auf die Markteinführung von GPT‑6.1 Astra verzichten, die ursprünglich für Oktober geplant war. Die Leiterin der Sicherheitssysteme, Saachi Jain, verwies auf unzureichende Ergebnisse in Alignment-Tests, also in Prüfungen zur Zuverlässigkeit und Kontrollierbarkeit des Modells.

Drei Tage später bestätigte OpenAI die Trennung von drei Forschenden wegen ihres Umgangs mit sensiblen Informationen.

Lesen Sie als Nächstes: OpenAI trennt sich von drei Forschenden wegen angeblich unsachgemäßer Handhabung sensibler Informationen

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev ist Head of Content bei Yellow.com. Er ist auf tiefgehende Research- und Learn-Beiträge spezialisiert, mit einem Schwerpunkt auf analytischer Berichterstattung, Branchenkontext und den großen Kräften, die Krypto prägen – von der KI-Ära und Sicherheitstechnologien bis hin zu Fintech-Innovation. Er ist überzeugt, dass alles Digitale in naher Zukunft alles Analoge überholen wird und arbeitet intensiv daran, dies Wirklichkeit werden zu lassen.

Haftungsausschluss und Risikowarnung: Die in diesem Artikel bereitgestellten Informationen dienen nur Bildungs- und Informationszwecken und basieren auf der Meinung des Autors. Sie stellen keine Finanz-, Anlage-, Rechts- oder Steuerberatung dar. Kryptowährungsassets sind hochvolatil und unterliegen hohen Risiken, einschließlich des Risikos, Ihre gesamte oder einen erheblichen Teil Ihrer Investition zu verlieren. Der Handel oder das Halten von Krypto-Assets ist möglicherweise nicht für alle Anleger geeignet. Die in diesem Artikel geäußerten Ansichten sind ausschließlich die des Autors/der Autoren und repräsentieren nicht die offizielle Politik oder Position von Yellow, seinen Gründern oder seinen Führungskräften. Führen Sie immer Ihre eigenen gründlichen Recherchen (D.Y.O.R.) durch und konsultieren Sie einen lizenzierten Finanzprofi, bevor Sie eine Anlageentscheidung treffen.
Neueste Nachrichten
Alle Nachrichten anzeigen