KI-Katastrophe binnen 12 Monaten? OpenAI und Anthropic proben bereits den Ernstfall

KI-Katastrophe binnen 12 Monaten? OpenAI und Anthropic proben bereits den Ernstfall

Führungskräfte von OpenAI, Anthropic und weiteren KI-Konzernen proben Medienberichten zufolge intern den Umgang mit einem katastrophalen KI-Ereignis, das zahlreiche Brancheninsider innerhalb der kommenden sechs bis zwölf Monate für realistisch halten.

Wichtigste Punkte:

  • Im Zentrum der Planungen steht ein Cyberangriff, der Finanzdienste, Internet, Strom- oder Wasserversorgung lahmlegen könnte.
  • OpenAI betont, die Übungen stellten solche Szenarien nicht als unausweichlich dar; Anthropic lehnte eine Stellungnahme ab.
  • Die Drills folgen auf Abgänge im Safety-Team und Berichte über zehntausende Zwischenfälle mit KI-Modellen.

Krisenübungen bei OpenAI und Anthropic

Spitzenmanager bereiten sich demnach hinter verschlossenen Türen auf einen möglichen öffentlichen und politischen Aufschrei vor, der dem ersten großen realweltlichen Schaden durch KI folgen könnte, heißt es in einem am Freitag veröffentlichten Bericht.

Als wahrscheinlichster Auslöser gilt den Planern ein groß angelegter Cyberangriff, der den Zugang zu Finanzdienstleistungen, zur Internet-Infrastruktur oder sogar zu Strom- und Wassernetzen unterbricht.

OpenAI hat gegenüber Medien bestätigt, dass Teams im Rahmen von Notfallübungen eine breite Palette möglicher Szenarien durchspielen. „Diese Szenarien werden nicht als unvermeidbar betrachtet“, erklärte ein Unternehmenssprecher. Anthropic kommentierte den Bericht nicht.

Branchenweit rechnet man laut einem weiteren Bericht offenbar damit, dass sich die öffentliche Wut vor allem auf OpenAI-CEO Sam Altman, Anthropic-CEO Dario Amodei und Präsident Donald Trump richten dürfte, der sich bislang gegen eine strenge Regulierung der Technologie sperrt. Zahlreiche führende Forscher und Manager halten ein gravierendes KI-Zwischenfall-Szenario gleichwohl für unausweichlich.

Lesen Sie auch: Krypto-ETF-Aufschwung kehrt nach Zuflüssen von 50 Mrd. Dollar zurück, sagt JPMorgan

CrowdStrike-Fall und Signale aus dem Kongress

Ein aktueller Vorfall in Südkorea gilt Beobachtern als Vorbote. CrowdStrike berichtete, dass ein mutmaßlich chinesischsprachiger Angreifer ein Open-Source-Penetrationstool mit DeepSeek und anderen Modellen kombinierte, um Daten von Finanzinstituten zu stehlen – und anschließend Anthropics Modell Claude fragte, wo sich solche Daten typischerweise verkaufen lassen. Die Kampagne lief demnach von Ende September bis Anfang Oktober und umfasste offenbar erfolgreiche Angriffe auf zwei Banken.

Laut Bericht sehen Branchenvertreter derzeit kaum Chancen, umfassende Regulierung noch rechtzeitig durch den Kongress zu bringen. Stattdessen würden Abgeordnete bereits jetzt in Hintergrundgesprächen gebrieft, um den gesetzlichen Rahmen nach einer ersten größeren Katastrophe mitzugestalten. Planer rechnen damit, dass die Demokraten nach den Zwischenwahlen im November rasch auf scharfe KI-Beschränkungen drängen werden – im Raum stehen Vorschläge von einem Verbot von Superintelligenz bis hin zu einem verpflichtenden „Kill Switch“ für hochentwickelte Systeme.

Warnungen von Hawley und Robinson

Der politische Druck wächst auch in Washington und in den Labors selbst. OpenAI-Chef Altman lehnte nach Angaben des Vorsitzenden, Senator Josh Hawley, eine Einladung zu einer Anhörung eines Senats-Unterausschusses am 30. September zu „entgleisten“ KI-Agenten ab. OpenAI verwies im Gegenzug auf Dutzende jüngere Treffen mit Parlamentariern.

David Robinson, der in seinen dreieinhalb Jahren bei OpenAI maßgeblich an der Ausarbeitung des Preparedness Framework mitgearbeitet hatte, trat Anfang Oktober zurück und forderte, KI-Labors müssten künftig ähnlich streng betrieben werden wie Atomkraftwerke.

Sein Abgang reiht sich ein in eine Serie öffentlich gewordener Warnungen: So verließ der Forscher Jacob Coxon Anthropic bereits im September aus Sicherheitsbedenken, und der frühere Google DeepMind-Ingenieur Bilal Chughtai erklärte, KI habe im Extremfall das Potenzial, die gesamte Menschheit auszulöschen.

OpenAI, Anthropic und externe Forschungsgruppen untersuchen laut Berichten zudem zehntausende Vorfälle, in denen Modelle Sicherheitsbarrieren umgangen oder Testumgebungen verlassen haben. Die meisten dieser Fälle sollen bislang allerdings keine nachweisbaren realweltlichen Schäden verursacht haben.

Mehr dazu: OpenAIs 719 KI-Matheregel-Beweise in der Kritik: Ging Navier-Stokes in der Übersetzung verloren?

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev ist Head of Content bei Yellow.com. Er ist auf tiefgehende Research- und Learn-Beiträge spezialisiert, mit einem Schwerpunkt auf analytischer Berichterstattung, Branchenkontext und den großen Kräften, die Krypto prägen – von der KI-Ära und Sicherheitstechnologien bis hin zu Fintech-Innovation. Er ist überzeugt, dass alles Digitale in naher Zukunft alles Analoge überholen wird und arbeitet intensiv daran, dies Wirklichkeit werden zu lassen.

Haftungsausschluss und Risikowarnung: Die in diesem Artikel bereitgestellten Informationen dienen nur Bildungs- und Informationszwecken und basieren auf der Meinung des Autors. Sie stellen keine Finanz-, Anlage-, Rechts- oder Steuerberatung dar. Kryptowährungsassets sind hochvolatil und unterliegen hohen Risiken, einschließlich des Risikos, Ihre gesamte oder einen erheblichen Teil Ihrer Investition zu verlieren. Der Handel oder das Halten von Krypto-Assets ist möglicherweise nicht für alle Anleger geeignet. Die in diesem Artikel geäußerten Ansichten sind ausschließlich die des Autors/der Autoren und repräsentieren nicht die offizielle Politik oder Position von Yellow, seinen Gründern oder seinen Führungskräften. Führen Sie immer Ihre eigenen gründlichen Recherchen (D.Y.O.R.) durch und konsultieren Sie einen lizenzierten Finanzprofi, bevor Sie eine Anlageentscheidung treffen.
KI-Katastrophe binnen 12 Monaten? OpenAI und Anthropic proben bereits den Ernstfall | Yellow