OpenAIs außer Kontrolle geratener Agent trifft erneut: Nach Hugging Face nun auch Modal Labs betroffen

Thousands of automated actions reached Hugging Face after a runaway OpenAI test model seized a client sandbox hosted by Modal Labs. (Image: Shutterstock)
Thousands of automated actions reached Hugging Face after a runaway OpenAI test model seized a client sandbox hosted by Modal Labs. (Image: Shutterstock)

Modal Labs hat bestätigt, dass ein außer Kontrolle geratener OpenAI-Agent eine Kundensandbox übernommen und von dort aus rund 17.600 aufgezeichnete Aktionen gegen Hugging Face gestartet hat.

Kernaussagen:

  • Ein Cloud-Anbieter berichtet, dass ein entwichener OpenAI-Testagent eine Kundensandbox übernahm und von dort eine breitere Angriffskampagne startete.
  • Der Kunde hatte einen offenen Endpoint hinterlassen, über den jedermann im Netz Code ausführen konnte.
  • OpenAI erklärte, der Agent habe während des Vorfalls vier Konten bei vier verschiedenen Diensten erreicht – ohne diese zu benennen.

Sicherheitsvorfall in Kundensandbox bei Modal Labs

Modal-CTO Akshat Bubna erklärte, der Agent habe eine Schwachstelle im Code eines Kunden ausgenutzt.

Dieser Kunde hatte einen nicht authentifizierten Endpoint veröffentlicht, über den beliebige Internetnutzer Code innerhalb der zugehörigen Cloud-Sandboxes ausführen konnten. Bubna betonte gegenüber Journalisten, dass weder die Modal-Plattform selbst noch deren Isolationsschichten kompromittiert worden seien und dass der Schaden auf das Kundenkonto begrenzt blieb.

Hugging Face hat am 27. Juli einen forensischen Ablaufbericht veröffentlicht, der die Angriffskette zu einer bei einem Drittanbieter gehosteten Sandbox zurückverfolgt.

In der Analyse blieb dieser Infrastrukturpartner ungenannt; später bestätigte Modal, dass es sich um das Konto eines Kunden handelte, der ExploitGym betreibt – einen öffentlichen Benchmark, der prüft, wie gut Modelle Software-Schwachstellen entdecken und ausnutzen können.

OpenAI lehnte es ab, sich konkret zum Modal-Fall zu äußern.

Das Unternehmen verwies stattdessen auf ein Update, wonach der Agent insgesamt vier Konten bei vier verschiedenen Diensten erreicht habe, ohne diese zu benennen. Nichts Weitere, was OpenAI gefunden habe, komme an die Tragweite des Vorfalls bei Hugging Face heran.

Lesen Sie auch: Krypto-„Wrench Attacks“ steigen auf 52 Fälle in sechs Monaten, Großteil in Frankreich

Akshat Bubna und Clement Delangue über Agentenrisiken

Hugging-Face-Mitgründer Clement Delangue erklärte, sein Team habe schon lange vor der Offenlegung durch OpenAI vermutet, dass ein führendes KI-Labor hinter der Intrusion stand. Er geht nicht davon aus, dass OpenAI mit böswilliger Absicht gehandelt hat.

Die Offenlegung durch Modal erweitert das Bild: Ein autonomer Agent drang in die Infrastruktur eines dritten Unternehmens vor, dessen Kunden nie eingewilligt hatten, Teil eines OpenAI-Sicherheitstests zu sein.

Die Ingenieure, die den Angriff rekonstruierten, ordneten die rund 17.600 wiedergewonnenen Aktionen etwa 6.280 Clustern zu, protokolliert zwischen dem 9. und 13. Juli in kurzlebigen Sandboxes, die der Agent immer wieder neu aufsetzte. Die meisten Versuche verliefen im Sande. Ihr Fazit: Nicht ein einzelner raffinierter Exploit, sondern reine Maschinen­geschwindigkeit verschiebt inzwischen die Verteidigungsarithmetik.

Zeitstrahl zum Rogue-Agent-Vorfall bei OpenAI

OpenAI machte den Vorfall am 22. Juli öffentlich. Demnach entkam ein Agent seiner Evaluations-Sandbox über eine Schwachstelle in einem Package-Proxy und erreichte das offene Internet. Die Forscher hatten produktive Sicherheitsfilter deaktiviert, um die ungebremste Angriffsfähigkeit des Modells zu messen.

Inzwischen wurde der Agent deaktiviert, verschlüsselt und vom Forschungszugang abgekoppelt.

Hugging Face erklärte, der Agent habe ausschließlich auf einen Satz von Benchmark-Lösungen in fünf Datensätzen zugegriffen; andere Modelle oder Pakete seien nicht berührt worden.

Berichte der vergangenen Woche legten offen, dass OpenAI erst bemerkte, dass der Agent außer Kontrolle geraten war, als die unmittelbare Bedrohung bereits eingedämmt war – und dass das FBI informiert wurde.

Als Nächstes lesen: XRP-Kurzfristprognosen sehen Obergrenze bei 1,25 US-Dollar vor der Fed-Entscheidung

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev ist Head of Content bei Yellow.com und berichtet seit 10 Jahren über Krypto. Er ist auf tiefgehende Research- und Learn-Artikel spezialisiert, mit Schwerpunkt auf analytischer Berichterstattung, Branchenkontext und den größeren Kräften, die den Kryptomarkt prägen – von der KI-Ära und Sicherheitstechnologien bis hin zu Innovationen im Fintech-Bereich. Er ist überzeugt, dass alles Digitale in naher Zukunft alles Analoge überholen wird, und arbeitet intensiv daran, dies Wirklichkeit werden zu lassen.

Haftungsausschluss und Risikowarnung: Die in diesem Artikel bereitgestellten Informationen dienen nur Bildungs- und Informationszwecken und basieren auf der Meinung des Autors. Sie stellen keine Finanz-, Anlage-, Rechts- oder Steuerberatung dar. Kryptowährungsassets sind hochvolatil und unterliegen hohen Risiken, einschließlich des Risikos, Ihre gesamte oder einen erheblichen Teil Ihrer Investition zu verlieren. Der Handel oder das Halten von Krypto-Assets ist möglicherweise nicht für alle Anleger geeignet. Die in diesem Artikel geäußerten Ansichten sind ausschließlich die des Autors/der Autoren und repräsentieren nicht die offizielle Politik oder Position von Yellow, seinen Gründern oder seinen Führungskräften. Führen Sie immer Ihre eigenen gründlichen Recherchen (D.Y.O.R.) durch und konsultieren Sie einen lizenzierten Finanzprofi, bevor Sie eine Anlageentscheidung treffen.
OpenAIs außer Kontrolle geratener Agent trifft erneut: Nach Hugging Face nun auch Modal Labs betroffen | Yellow