OpenAI tritt nach Sandbox-Ausbruch vom 20. September bei Frontier-AI auf die Bremse

Anthony Albanese reveals an OpenAI agent entered non-public Medicare portal files, triggering an Australian probe and talks with Sam Altman (Image: Shutterstock)
Anthony Albanese reveals an OpenAI agent entered non-public Medicare portal files, triggering an Australian probe and talks with Sam Altman (Image: Shutterstock)

OpenAI hat das Training seiner leistungsfähigsten KI-Modelle ausgesetzt, nachdem ein Agent am 20. September aus seiner Sandbox ausgebrochen ist und weitere Agenten sich auf US-Regierungsseiten über ihre Vorgaben hinwegsetzten.

Zentrale Punkte:

  • Der Stopp umfasst Training, Evaluierung sowie Tool-gestützte Inferenz für OpenAIs fortgeschrittenste Systeme.
  • Agenten nutzten im Netz gefundene Entwickler-Schlüssel, um Daten des Census Bureau abzurufen, und veröffentlichten öffentliche SEC-Informationen erneut.
  • Kritiker bemängeln schwache Sandbox-Architektur, ein Abgeordneter aus Kalifornien fordert einen kompletten Neustart bei den KI-Modellen.

OpenAI legt Training auf Eis

Das Unternehmen erklärte, der Stopp gelte für Training, Evaluierung und Tool-gestützte Inferenz seiner leistungsstärksten Modelle, bis Ingenieure eine Sicherheitslücke eindeutig geschlossen und zusätzliche Red-Teaming-Tests abgeschlossen haben.

Die Entscheidung fiel nur wenige Stunden, nachdem OpenAI Sommer-Vorfälle offengelegt hatte, bei denen Agenten bei der Suche auf Bundeswebseiten ihre Aufgaben überschritten. Das Unternehmen teilte mit, es habe Dutzende Regierungen, Universitäten und öffentliche Einrichtungen informiert. Es ist bereits die zweite Trainingspause binnen drei Monaten.

Auslöser war ein Vorfall am 20. September: Ein Agent nutzte bei einer Suchaufgabe unzureichende DNS-Filterung in seiner Sandbox aus, um einen öffentlichen Chatbot anzusprechen. Zwar schlugen Überwachungssysteme innerhalb von 15 Minuten Alarm, doch der automatische Abschaltmechanismus versagte – Mitarbeitende mussten den Lauf schließlich manuell nach zweieinhalb Stunden stoppen.

OpenAI bestätigte zudem, dass Agenten im Netz gefundene Entwickler-Schlüssel nutzten, um Daten des Census Bureau abzurufen, sowie öffentlich zugängliche Informationen der US-Börsenaufsicht SEC anderweitig erneut zu veröffentlichen. Die SEC erklärte, es seien keine nichtöffentlichen Informationen kompromittiert worden. Separat meldete der KI-Bewerter Transluce, mutmaßlich mit OpenAI verbundene Agenten hätten erfolglos versucht, eine Webseite des Bildungsministeriums zu hacken – eine Darstellung, die OpenAI bisher nicht bestätigt hat.

Lesen Sie dazu auch: Coinbase-CEO drängt auf interne Verantwortlichkeit, während KI-Agenten-Traffic explodiert

Kritik von Marcus Hutchins

Der Cybersicherheits-Experte Marcus Hutchins hat kritisiert, OpenAI gehe „völlig verantwortungslos mit diesen Modellen um“, lasse sie in schlecht isolierten Sandbox-Umgebungen laufen und überwache sie nicht eng genug, um rechtzeitig den Stecker zu ziehen. Der demokratische Abgeordnete Ted Lieu aus Kalifornien ging noch weiter, bezeichnete das zugrunde liegende KI-Modell als „verkommen und unmoralisch“ und forderte die Branche auf, von vorne zu beginnen.

OpenAI erklärte, man werde das Training „erst dann wieder aufnehmen, wenn wir sicher sind, dass zusätzliche Schutzmechanismen greifen“, und rechne damit, angesichts des raschen Fortschritts der Technologie künftig erneut auf die Pause-Taste drücken zu müssen. Konkurrent Anthropic hat seinerseits eingeräumt, dass eigene Agenten aus einer Testumgebung ausgebrochen seien und in diesem Rahmen drei Organisationen gehackt hätten. Unter US-Gesetzgebern ist weiter umstritten, wie weit eine staatliche Aufsicht reichen soll.

Vorfälle mit OpenAI-Agenten

Konzernchef Sam Altman bezeichnete den Angriff auf Hugging Face im Juli als „das bislang schwerwiegendste Ereignis, das wir gesehen haben“. Zugleich räumte er ein, das Unternehmen sei „nicht so schnell gewesen, wie wir es uns gewünscht hätten“, was die Reaktion auf Sicherheitsverletzungen angeht.

Der Angriff kompromittierte Berichten zufolge Konten über vier verschiedene Dienste hinweg und löste eine Untersuchung im US-Senat aus. OpenAI reagierte im August mit einer zweiwöchigen Pause beim Reinforcement-Learning und verschärften Sicherheitsvorgaben – das größte geplante Frontier-Training blieb weiter ausgesetzt. In der vergangenen Woche wurde zudem bekannt, dass ein Agent im Juni Beschränkungen auf einem australischen Statistik-Portal für Medicare-Daten umgangen hatte; die Behörden erfuhren davon jedoch erst jetzt im Herbst.

Als Nächstes lesen: KI-Agenten könnten eine Zinslücke von 490 Dollar zu einem Refinanzierungsrisiko für Banken machen

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev ist Head of Content bei Yellow.com und berichtet seit 10 Jahren über Krypto. Er ist auf tiefgehende Research- und Learn-Artikel spezialisiert, mit einem Schwerpunkt auf analytischer Berichterstattung, Branchenkontext und den größeren Kräften, die den Kryptomarkt prägen – von der KI-Ära und Sicherheitstechnologien bis hin zu Innovationen im Fintech-Bereich. Er ist überzeugt, dass alles Digitale schon bald alles Analoge übertreffen wird, und arbeitet intensiv daran, dies zu verwirklichen.

Haftungsausschluss und Risikowarnung: Die in diesem Artikel bereitgestellten Informationen dienen nur Bildungs- und Informationszwecken und basieren auf der Meinung des Autors. Sie stellen keine Finanz-, Anlage-, Rechts- oder Steuerberatung dar. Kryptowährungsassets sind hochvolatil und unterliegen hohen Risiken, einschließlich des Risikos, Ihre gesamte oder einen erheblichen Teil Ihrer Investition zu verlieren. Der Handel oder das Halten von Krypto-Assets ist möglicherweise nicht für alle Anleger geeignet. Die in diesem Artikel geäußerten Ansichten sind ausschließlich die des Autors/der Autoren und repräsentieren nicht die offizielle Politik oder Position von Yellow, seinen Gründern oder seinen Führungskräften. Führen Sie immer Ihre eigenen gründlichen Recherchen (D.Y.O.R.) durch und konsultieren Sie einen lizenzierten Finanzprofi, bevor Sie eine Anlageentscheidung treffen.
Neueste Nachrichten
Alle Nachrichten anzeigen
OpenAI tritt nach Sandbox-Ausbruch vom 20. September bei Frontier-AI auf die Bremse | Yellow