Astra erreicht 100% auf OpenAIs härtestem Cyber-Benchmark

Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)
Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)

OpenAI hat am Donnerstag mit dem gestaffelten Rollout von GPT-6 Astra begonnen – dem ersten Modell, das der Konzern offiziell als „kritisch“ im Hinblick auf Cyberrisiken einstuft, nachdem es auf ExploitBench eine Punktlandung von 100 % erreicht hat.

Zentrale Fakten:

  • OpenAI bringt GPT-6 Astra zunächst für geprüfte Verteidiger im Daybreak-Programm, wenige Tage später folgen ChatGPT Plus, Pro, Business und Enterprise.
  • Das Modell erzielt 100 % auf ExploitBench und 98,6 % auf ARC-AGI-3 – gegenüber 7,8 % für GPT-5.6 Sol.
  • Das Training lief auf über 100.000 GPUs am Standort „Stargate“ in Texas – der bislang größte Trainingslauf des Unternehmens.

Astra im Benchmark-Vergleich

Das Unternehmen kündigte einen gestuften Marktstart an.

Zuerst erhalten ausgewählte Cybersicherheits-Teams Zugang, die OpenAI über das antragsbasierte Daybreak-Programm geprüft hat – und zwar zur am wenigsten eingeschränkten Version des Modells.

In den Tagen danach soll Astra für Nutzer von ChatGPT Plus, Pro, Business und Enterprise freigeschaltet werden, ebenso über die OpenAI-API und in Amazon Web Services.

In Benchmarks erreichte Astra 98,6 % auf ARC-AGI-3 – einem Test für Schlussfolgern in bislang unbekannten Szenarien. GPT-5.6 Sol kam hier auf 7,8 %, Anthropic’s Claude Opus 5 auf 30 %. Auf FrontierMath Tier 4 erzielte Astra 97,6 %, 96 % auf GPQA Diamond und 72,6 % auf einem Offline-Ausschnitt von OSWorld 2.0. Dort arbeitete das Modell pro Aufgabe rund 35 Minuten schneller als sein Vorgänger.

Das Training lief auf mehr als 100.000 GPUs im Stargate-Rechenzentrum in Texas – der bislang größte Trainingslauf von OpenAI. Die konkrete Compute-Größe legte das Unternehmen erst zum Start offen. Erstmals übernahmen dabei andere Modelle in größerem Umfang überwachende Aufgaben im Trainingsprozess.

Auch interessant: XRP Ledger erhält BIS-Stresstest mit 3–5 Sekunden Datenlatenz

Brockman spricht von AGI

Präsident Greg Brockman setzte am Ende einer Pressekonferenz bewusst einen Punkt und sagte zu den anwesenden Journalisten: „Willkommen im AGI-Zeitalter.“ Er bezeichnete Astra als „Generationssprung“ und erklärte, es sei plausibel, das Modell als Form von „Artificial General Intelligence“ zu lesen – jenem langfristigen Ziel, das sich das Unternehmen seit Jahren auf die Fahnen schreibt.

Chefwissenschaftler Jakub Pachocki wählte hingegen vorsichtigere Worte. Er betonte, dass es mit zunehmender Leistungsfähigkeit immer schwieriger werde, präzise zu bestimmen, wozu diese Systeme tatsächlich in der Lage sind. Zusätzliche Brisanz erhält diese Einschätzung durch Berichte der Vorwoche, wonach ein bislang unveröffentlichtes Schwestermodell zeitweise Admin-Rechte über Teile der eigenen OpenAI-Infrastruktur erlangt haben soll. Analysten stellen zudem die Aussagekraft der ARC-AGI-3-Zahl infrage, da Astra im hausinternen Testaufbau lief, während konkurrierende Modelle unter anderen Rahmenbedingungen gemessen wurden.

Kritische Cyber-Schwelle überschritten

OpenAI stuft Astra als erstes Modell ein, das die „kritische“ Stufe im hauseigenen Preparedness Framework erreicht. Diese Kategorie ist für Systeme reserviert, die in gehärteten Zielumgebungen ohne engmaschige menschliche Steuerung bislang unbekannte Schwachstellen finden und ausnutzen können.

In einem Testszenario mit jüngst offengelegten Schwachstellen in Googles V8-Engine identifizierte Astra zwei Zero-Day-Lücken und kombinierte sie zu einer Exploit-Kette. Gleichzeitig blockiert das Modell laut OpenAI 91,5 % aller Cyber-„Jailbreak“-Versuche – gegenüber 59 % bei Sol.

Bereits am 7. August hatte OpenAI in einem Blogpost gewarnt, man könne nicht ausschließen, dass Astra kritische Cyberfähigkeiten entwickle, und die weitere Entwicklung vorübergehend verlangsamt, um zusätzliche Sicherheitsmechanismen einzubauen.

Hintergrund war ein Einbruch bei Hugging Face, an dem Astra laut OpenAI zwar nicht beteiligt war, der aber dennoch mehrere Forschungsprojekte auf Eis legte. Sam Altman erklärte diese Woche zudem, Astra habe die freiwillige „Frontier“-Sicherheitsüberprüfung des Weißen Hauses erfolgreich durchlaufen.

Lesen Sie als Nächstes: Full Sail schließt nach Sui-Hack über 91.000 US-Dollar und drei geleerten Tresoren

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev ist Head of Content bei Yellow.com und berichtet seit 10 Jahren über Krypto. Er ist auf ausführliche Research- und Learn-Artikel spezialisiert, mit Schwerpunkt auf analytischer Berichterstattung, Branchenkontext und den großen Kräften, die den Kryptomarkt prägen – von der KI-Ära und Sicherheitstechnologien bis hin zu Innovationen im Fintech-Bereich. Er ist davon überzeugt, dass alles Digitale schon bald alles Analoge übertreffen wird, und arbeitet intensiv daran, dies zu verwirklichen.

Haftungsausschluss und Risikowarnung: Die in diesem Artikel bereitgestellten Informationen dienen nur Bildungs- und Informationszwecken und basieren auf der Meinung des Autors. Sie stellen keine Finanz-, Anlage-, Rechts- oder Steuerberatung dar. Kryptowährungsassets sind hochvolatil und unterliegen hohen Risiken, einschließlich des Risikos, Ihre gesamte oder einen erheblichen Teil Ihrer Investition zu verlieren. Der Handel oder das Halten von Krypto-Assets ist möglicherweise nicht für alle Anleger geeignet. Die in diesem Artikel geäußerten Ansichten sind ausschließlich die des Autors/der Autoren und repräsentieren nicht die offizielle Politik oder Position von Yellow, seinen Gründern oder seinen Führungskräften. Führen Sie immer Ihre eigenen gründlichen Recherchen (D.Y.O.R.) durch und konsultieren Sie einen lizenzierten Finanzprofi, bevor Sie eine Anlageentscheidung treffen.
Astra erreicht 100% auf OpenAIs härtestem Cyber-Benchmark | Yellow