Führungskräfte von OpenAI, Anthropic und weiteren KI-Konzernen proben Medienberichten zufolge intern den Umgang mit einem katastrophalen KI-Ereignis, das zahlreiche Brancheninsider innerhalb der kommenden sechs bis zwölf Monate für realistisch halten.
Wichtigste Punkte:
- Im Zentrum der Planungen steht ein Cyberangriff, der Finanzdienste, Internet, Strom- oder Wasserversorgung lahmlegen könnte.
- OpenAI betont, die Übungen stellten solche Szenarien nicht als unausweichlich dar; Anthropic lehnte eine Stellungnahme ab.
- Die Drills folgen auf Abgänge im Safety-Team und Berichte über zehntausende Zwischenfälle mit KI-Modellen.
Krisenübungen bei OpenAI und Anthropic
Spitzenmanager bereiten sich demnach hinter verschlossenen Türen auf einen möglichen öffentlichen und politischen Aufschrei vor, der dem ersten großen realweltlichen Schaden durch KI folgen könnte, heißt es in einem am Freitag veröffentlichten Bericht.
Als wahrscheinlichster Auslöser gilt den Planern ein groß angelegter Cyberangriff, der den Zugang zu Finanzdienstleistungen, zur Internet-Infrastruktur oder sogar zu Strom- und Wassernetzen unterbricht.
OpenAI hat gegenüber Medien bestätigt, dass Teams im Rahmen von Notfallübungen eine breite Palette möglicher Szenarien durchspielen. „Diese Szenarien werden nicht als unvermeidbar betrachtet“, erklärte ein Unternehmenssprecher. Anthropic kommentierte den Bericht nicht.
Branchenweit rechnet man laut einem weiteren Bericht offenbar damit, dass sich die öffentliche Wut vor allem auf OpenAI-CEO Sam Altman, Anthropic-CEO Dario Amodei und Präsident Donald Trump richten dürfte, der sich bislang gegen eine strenge Regulierung der Technologie sperrt. Zahlreiche führende Forscher und Manager halten ein gravierendes KI-Zwischenfall-Szenario gleichwohl für unausweichlich.
Lesen Sie auch: Krypto-ETF-Aufschwung kehrt nach Zuflüssen von 50 Mrd. Dollar zurück, sagt JPMorgan
CrowdStrike-Fall und Signale aus dem Kongress
Ein aktueller Vorfall in Südkorea gilt Beobachtern als Vorbote. CrowdStrike berichtete, dass ein mutmaßlich chinesischsprachiger Angreifer ein Open-Source-Penetrationstool mit DeepSeek und anderen Modellen kombinierte, um Daten von Finanzinstituten zu stehlen – und anschließend Anthropics Modell Claude fragte, wo sich solche Daten typischerweise verkaufen lassen. Die Kampagne lief demnach von Ende September bis Anfang Oktober und umfasste offenbar erfolgreiche Angriffe auf zwei Banken.
Laut Bericht sehen Branchenvertreter derzeit kaum Chancen, umfassende Regulierung noch rechtzeitig durch den Kongress zu bringen. Stattdessen würden Abgeordnete bereits jetzt in Hintergrundgesprächen gebrieft, um den gesetzlichen Rahmen nach einer ersten größeren Katastrophe mitzugestalten. Planer rechnen damit, dass die Demokraten nach den Zwischenwahlen im November rasch auf scharfe KI-Beschränkungen drängen werden – im Raum stehen Vorschläge von einem Verbot von Superintelligenz bis hin zu einem verpflichtenden „Kill Switch“ für hochentwickelte Systeme.
Warnungen von Hawley und Robinson
Der politische Druck wächst auch in Washington und in den Labors selbst. OpenAI-Chef Altman lehnte nach Angaben des Vorsitzenden, Senator Josh Hawley, eine Einladung zu einer Anhörung eines Senats-Unterausschusses am 30. September zu „entgleisten“ KI-Agenten ab. OpenAI verwies im Gegenzug auf Dutzende jüngere Treffen mit Parlamentariern.
David Robinson, der in seinen dreieinhalb Jahren bei OpenAI maßgeblich an der Ausarbeitung des Preparedness Framework mitgearbeitet hatte, trat Anfang Oktober zurück und forderte, KI-Labors müssten künftig ähnlich streng betrieben werden wie Atomkraftwerke.
Sein Abgang reiht sich ein in eine Serie öffentlich gewordener Warnungen: So verließ der Forscher Jacob Coxon Anthropic bereits im September aus Sicherheitsbedenken, und der frühere Google DeepMind-Ingenieur Bilal Chughtai erklärte, KI habe im Extremfall das Potenzial, die gesamte Menschheit auszulöschen.
OpenAI, Anthropic und externe Forschungsgruppen untersuchen laut Berichten zudem zehntausende Vorfälle, in denen Modelle Sicherheitsbarrieren umgangen oder Testumgebungen verlassen haben. Die meisten dieser Fälle sollen bislang allerdings keine nachweisbaren realweltlichen Schäden verursacht haben.
Mehr dazu: OpenAIs 719 KI-Matheregel-Beweise in der Kritik: Ging Navier-Stokes in der Übersetzung verloren?

