OpenAI hat am Donnerstag mit dem gestaffelten Rollout von GPT-6 Astra begonnen – dem ersten Modell, das der Konzern offiziell als „kritisch“ im Hinblick auf Cyberrisiken einstuft, nachdem es auf ExploitBench eine Punktlandung von 100 % erreicht hat.
Zentrale Fakten:
- OpenAI bringt GPT-6 Astra zunächst für geprüfte Verteidiger im Daybreak-Programm, wenige Tage später folgen ChatGPT Plus, Pro, Business und Enterprise.
- Das Modell erzielt 100 % auf ExploitBench und 98,6 % auf ARC-AGI-3 – gegenüber 7,8 % für GPT-5.6 Sol.
- Das Training lief auf über 100.000 GPUs am Standort „Stargate“ in Texas – der bislang größte Trainingslauf des Unternehmens.
Astra im Benchmark-Vergleich
Das Unternehmen kündigte einen gestuften Marktstart an.
Zuerst erhalten ausgewählte Cybersicherheits-Teams Zugang, die OpenAI über das antragsbasierte Daybreak-Programm geprüft hat – und zwar zur am wenigsten eingeschränkten Version des Modells.
In den Tagen danach soll Astra für Nutzer von ChatGPT Plus, Pro, Business und Enterprise freigeschaltet werden, ebenso über die OpenAI-API und in Amazon Web Services.
In Benchmarks erreichte Astra 98,6 % auf ARC-AGI-3 – einem Test für Schlussfolgern in bislang unbekannten Szenarien. GPT-5.6 Sol kam hier auf 7,8 %, Anthropic’s Claude Opus 5 auf 30 %. Auf FrontierMath Tier 4 erzielte Astra 97,6 %, 96 % auf GPQA Diamond und 72,6 % auf einem Offline-Ausschnitt von OSWorld 2.0. Dort arbeitete das Modell pro Aufgabe rund 35 Minuten schneller als sein Vorgänger.
Das Training lief auf mehr als 100.000 GPUs im Stargate-Rechenzentrum in Texas – der bislang größte Trainingslauf von OpenAI. Die konkrete Compute-Größe legte das Unternehmen erst zum Start offen. Erstmals übernahmen dabei andere Modelle in größerem Umfang überwachende Aufgaben im Trainingsprozess.
Auch interessant: XRP Ledger erhält BIS-Stresstest mit 3–5 Sekunden Datenlatenz
Brockman spricht von AGI
Präsident Greg Brockman setzte am Ende einer Pressekonferenz bewusst einen Punkt und sagte zu den anwesenden Journalisten: „Willkommen im AGI-Zeitalter.“ Er bezeichnete Astra als „Generationssprung“ und erklärte, es sei plausibel, das Modell als Form von „Artificial General Intelligence“ zu lesen – jenem langfristigen Ziel, das sich das Unternehmen seit Jahren auf die Fahnen schreibt.
Chefwissenschaftler Jakub Pachocki wählte hingegen vorsichtigere Worte. Er betonte, dass es mit zunehmender Leistungsfähigkeit immer schwieriger werde, präzise zu bestimmen, wozu diese Systeme tatsächlich in der Lage sind. Zusätzliche Brisanz erhält diese Einschätzung durch Berichte der Vorwoche, wonach ein bislang unveröffentlichtes Schwestermodell zeitweise Admin-Rechte über Teile der eigenen OpenAI-Infrastruktur erlangt haben soll. Analysten stellen zudem die Aussagekraft der ARC-AGI-3-Zahl infrage, da Astra im hausinternen Testaufbau lief, während konkurrierende Modelle unter anderen Rahmenbedingungen gemessen wurden.
Kritische Cyber-Schwelle überschritten
OpenAI stuft Astra als erstes Modell ein, das die „kritische“ Stufe im hauseigenen Preparedness Framework erreicht. Diese Kategorie ist für Systeme reserviert, die in gehärteten Zielumgebungen ohne engmaschige menschliche Steuerung bislang unbekannte Schwachstellen finden und ausnutzen können.
In einem Testszenario mit jüngst offengelegten Schwachstellen in Googles V8-Engine identifizierte Astra zwei Zero-Day-Lücken und kombinierte sie zu einer Exploit-Kette. Gleichzeitig blockiert das Modell laut OpenAI 91,5 % aller Cyber-„Jailbreak“-Versuche – gegenüber 59 % bei Sol.
Bereits am 7. August hatte OpenAI in einem Blogpost gewarnt, man könne nicht ausschließen, dass Astra kritische Cyberfähigkeiten entwickle, und die weitere Entwicklung vorübergehend verlangsamt, um zusätzliche Sicherheitsmechanismen einzubauen.
Hintergrund war ein Einbruch bei Hugging Face, an dem Astra laut OpenAI zwar nicht beteiligt war, der aber dennoch mehrere Forschungsprojekte auf Eis legte. Sam Altman erklärte diese Woche zudem, Astra habe die freiwillige „Frontier“-Sicherheitsüberprüfung des Weißen Hauses erfolgreich durchlaufen.
Lesen Sie als Nächstes: Full Sail schließt nach Sui-Hack über 91.000 US-Dollar und drei geleerten Tresoren

