OpenAI beschleunigt GPT-5.6 Sol um das 14‑Fache mit neuem Ultrafast-Modus

New Ultrafast mode pushes GPT-5.6 Sol to 14x standard processing speed (Image: Shutterstock)
New Ultrafast mode pushes GPT-5.6 Sol to 14x standard processing speed (Image: Shutterstock)

OpenAI hat Ultrafast vorgestellt, eine neue Preview-Serviceklasse, in der GPT-5.6 Sol bis zu 14‑mal schneller als im Standardbetrieb läuft und bis zu 750 Ausgabetoken pro Sekunde erzeugt.

Kernaussagen:

  • Ultrafast lässt GPT-5.6 Sol bis zu 14‑mal schneller laufen als die Standardverarbeitung.
  • Cerebras stellt die Rechenleistung, mit der bis zu 750 Ausgabetoken pro Sekunde möglich sind.
  • Der Dienst befindet sich in einer limitierten Preview-Phase; breiterer Zugang soll mit wachsender Kapazität folgen.

OpenAI Ultrafast in der Preview

OpenAI hat Ultrafast am 13. August per Ankündigung vorgestellt und die geschwindigkeitsoptimierte Stufe zunächst über die API für einen begrenzten Kundenkreis gestartet. Das Unternehmen betonte, der Zugang solle ausgeweitet werden, sobald zusätzliche Kapazitäten bereitstehen.

Der Dienst basiert auf Cerebras-Hardware und ist laut einem Bericht darauf ausgelegt, die Fähigkeiten von GPT-5.6 Sol zu erhalten, gleichzeitig aber die Antwortzeiten deutlich zu verkürzen. Ausgabetoken sind Einheiten des generierten Textes. OpenAI verweist darauf, dass Echtzeit-Performance bislang in der Regel bedeutete, auf kleinere oder hochspezialisierte Modelle ausweichen zu müssen – Ultrafast ziele dagegen auf „mehr nutzbare Arbeit pro Sekunde“.

Zu den Workflows, die laut OpenAI besonders profitieren sollen, zählen Incident Response, Finanzanalyse, Kundenservice, E‑Commerce und Live-Recherche. Ingenieure können den Modus nutzen, um während eines laufenden Ausfalls Logs, Traces und jüngste Codeänderungen zu prüfen, während Supportsysteme mehrstufige Anfragen in laufenden Kundengesprächen abarbeiten können.

Lesen Sie auch: Anthropic verfolgt 6‑Mrd.-Dollar-Decart-Deal und bereitet Börsengang vor

Auswirkungen von GPT-5.6 Sol

Frühe Unternehmenskunden berichten, die höhere Geschwindigkeit verändere, wie sich das Modell in interaktive Arbeitsabläufe einbinden lasse. John Crepezzi von Jane Street nannte den Performance-Sprung „beeindruckend“ und erklärte, er mache fokussierte, eng verzahnte Zusammenarbeit mit Modellen deutlich praktikabler.

Courtland Lykins, Produktverantwortlicher für Voice-AI bei Podium, sagte, Ultrafast sei ein wichtiger Baustein im Voice-Stack des Unternehmens, weil „die Geschwindigkeit das gesamte Anruferlebnis“ bei komplexen Aufgaben grundlegend verändere. OpenAI betont außerdem, dass Finanzanalysten mit dem Modus Marktbewegungen und Transaktionen auswerten können, ohne auf langsamere Batch-Verarbeitung warten zu müssen – ein Szenario, das besonders stark von sich schnell ändernden Eingabedaten abhängt.

Die Preview bleibt vorerst durch Infrastrukturkapazitäten begrenzt und ist noch kein breiter öffentlicher Rollout. OpenAI sammelt Feedback der ersten Unternehmenskunden, um zu bestimmen, in welchen Anwendungsfeldern der Geschwindigkeitsvorteil den größten Mehrwert bringt, bevor der Zugang skaliert wird.

Die Verbindung zu Cerebras besteht bereits länger. OpenAI hatte im Januar eine Partnerschaft mit dem Chipanbieter bekanntgegeben, um seiner Plattform 750 Megawatt zusätzlicher, latenzarmer KI-Rechenleistung hinzuzufügen. Im Februar wurde GPT-5.3-Codex-Spark als erstes Modell aus dieser Kooperation eingeführt und nutzte Cerebras-Hardware, um in Echtzeit-Coding-Szenarien mehr als 1.000 Token pro Sekunde zu erreichen.

Als Nächstes lesen: Virtuals Protocol: Handelsvolumen schießt um 180 % nach oben, Bullen peilen 0,68 US‑Dollar an

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev ist Head of Content bei Yellow.com und berichtet seit 10 Jahren über Krypto. Er ist auf tiefgehende Research- und Learn-Artikel spezialisiert, mit Schwerpunkt auf analytischer Berichterstattung, Branchenkontext und den größeren Kräften, die den Kryptomarkt prägen – von der KI-Ära und Sicherheitstechnologien bis hin zu Innovationen im Fintech-Bereich. Er ist überzeugt, dass alles Digitale in naher Zukunft alles Analoge überholen wird, und arbeitet intensiv daran, dies Wirklichkeit werden zu lassen.

Haftungsausschluss und Risikowarnung: Die in diesem Artikel bereitgestellten Informationen dienen nur Bildungs- und Informationszwecken und basieren auf der Meinung des Autors. Sie stellen keine Finanz-, Anlage-, Rechts- oder Steuerberatung dar. Kryptowährungsassets sind hochvolatil und unterliegen hohen Risiken, einschließlich des Risikos, Ihre gesamte oder einen erheblichen Teil Ihrer Investition zu verlieren. Der Handel oder das Halten von Krypto-Assets ist möglicherweise nicht für alle Anleger geeignet. Die in diesem Artikel geäußerten Ansichten sind ausschließlich die des Autors/der Autoren und repräsentieren nicht die offizielle Politik oder Position von Yellow, seinen Gründern oder seinen Führungskräften. Führen Sie immer Ihre eigenen gründlichen Recherchen (D.Y.O.R.) durch und konsultieren Sie einen lizenzierten Finanzprofi, bevor Sie eine Anlageentscheidung treffen.