Der frühere Google DeepMind-Sicherheitsforscher Bilal Chughtai warnt, dass KI die Menschheit auslöschen könnte, während ein weiterer Ex-Forscher schwerwiegende Schäden schon innerhalb von fünf Jahren für möglich hält.
Zentrale Punkte:
- Chughtai verließ DeepMind im Juli und hält das Entstehen von Superintelligenz in den nächsten Jahren für realistisch.
- Er warnt, die Alignment-Forschung hinke den Fähigkeitszuwächsen hinterher, und plädiert für ein koordiniertes Abbremsen – nicht für einen Stopp der KI-Entwicklung.
- Ex-DeepMind-Forscher Josh Engels sieht ein Risiko massiver Schäden binnen fünf Jahren; Vertreter von Anthropic und OpenAI unterstützen ebenfalls Forderungen nach einem gemäßigten Entwicklungstempo.
Chughtais Warnung vor KI-Risiken
Chughtai, ehemals Research Engineer mit Schwerpunkt auf Sicherheit und Alignment im Bereich künstlicher allgemeiner Intelligenz (AGI), hatte sich bei DeepMind genau diesen Fragen gewidmet. Nach seinem Abschied im Juli veröffentlichte er nun eine eindringliche Warnung. Zuvor hatte er sich bereits in einem Beitrag mit AGI-Sicherheitsfragen befasst.
Nach seiner Einschätzung könnten große KI-Labore in den nächsten Jahren Systeme entwickeln, die Menschen in nahezu allen Bereichen übertreffen – und gleichzeitig nur schwer zuverlässig an menschliche Ziele und Werte anzupassen sind.
Das Kernproblem sei das Alignment, schrieb Chughtai: „Ich glaube aufrichtig, dass KI das Potenzial hat, uns alle zu töten, und dass uns womöglich die Zeit davonläuft, um dieses Szenario noch abzuwenden.“
Die heutigen Methoden, hochentwickelte Systeme stabil auf menschliche Ziele auszurichten, seien „extrem rudimentär“, während die Fähigkeiten von Frontier-Modellen weit schneller wüchsen als das Verständnis der Forscher für Alignment. Ein komplettes Moratorium lehnt er allerdings ab. Stattdessen fordert Chughtai, dass Unternehmen sich enger abstimmen, den Wettlauf um Fähigkeiten verlangsamen und deutlich mehr Transparenz darüber schaffen, wie Spitzenmodelle entwickelt und getestet werden.
Lesen Sie dazu auch: CLARITY Act Faces 60-Vote Senate Test As Opposition Grows
Sicherheitsdebatte bei Anthropic
Chughtais Alarm folgt auf den Rücktritt von Jacob Coxon Anfang des Monats, der drei Jahre lang bei Anthropic und OpenAI tätig war. Evan Hubinger, Leiter der Alignment-Forschung bei Anthropic, erklärte anschließend, er sehe eine Wahrscheinlichkeit von über 10 %, dass KI alle Menschen töten könnte – und das bereits innerhalb des kommenden Jahrzehnts.
Josh Engels, der ebenfalls im Sicherheitsteam von DeepMind arbeitete, teilte am 12. September mit, er habe sich der Evaluationsorganisation METR angeschlossen, nachdem er Angebote von Anthropic und OpenAI ausgeschlagen habe. Begründung: eine „erschreckend hohe Wahrscheinlichkeit“ enormer KI-Schäden in den nächsten fünf Jahren.
Anthropic-CEO Dario Amodei drängt seit Längerem darauf, die Steigerung der Fähigkeiten zu drosseln – eine Linie, die auch OpenAI-Chef Sam Altman unterstützt. Das ist deshalb bemerkenswert, weil die Warnungen inzwischen nicht nur von abwandernden Sicherheitsforschern kommen, sondern auch von Spitzenmanagern führender KI-Labore.
Die aktuellen Alarmrufe markieren eine deutliche Wende seit Anfang 2022, als Chughtai seine Arbeit an KI aufnahm und die damaligen Systeme noch als deutlich weniger leistungsfähig beschrieb als heutige Frontier-Modelle. Binnen nur vier Jahren hat sich die Debatte von abstrakten Langfristszenarien hin zu sehr konkreten Fragen verlagert: Wie autonom dürfen Modelle werden? Lassen sie sich verlässlich ausrichten? Und kann die Sicherheitsforschung überhaupt noch mit dem Tempo der Fähigkeitszuwächse Schritt halten?
Mehr zum Thema: Bitget's API Now Reaches Gold, Forex, Indices And Crude Oil

