OpenAI beschleunigt GPT-5.6 Sol um das 14‑Fache mit neuem Ultrafast‑Modus

New Ultrafast mode pushes GPT-5.6 Sol to 14x standard processing speed (Image: Shutterstock)
New Ultrafast mode pushes GPT-5.6 Sol to 14x standard processing speed (Image: Shutterstock)

OpenAI hat Ultrafast vorgestellt, eine neue Preview‑Serviceklasse, in der GPT-5.6 Sol bis zu 14‑mal schneller als im Standardbetrieb läuft und bis zu 750 Ausgabetokens pro Sekunde erzeugt.

Zentrale Punkte:

  • Ultrafast lässt GPT‑5.6 Sol bis zu 14‑mal schneller laufen als die Standardverarbeitung.
  • Cerebras stellt die Rechenbasis für den Modus, der bis zu 750 Ausgabetokens pro Sekunde liefern kann.
  • Der Dienst befindet sich in einer begrenzten Preview‑Phase; der Zugang soll mit wachsender Kapazität ausgeweitet werden.

OpenAI Ultrafast in der Preview

OpenAI hat Ultrafast am 13. August angekündigt und die geschwindigkeitsoptimierte Stufe zunächst über die API für eine begrenzte Kundengruppe freigeschaltet. Das Unternehmen kündigte an, den Zugang mit zunehmender Kapazität auszuweiten.

Der Dienst wird von Cerebras‑Hardware angetrieben und ist laut Konzept darauf ausgelegt, die Fähigkeiten von GPT‑5.6 Sol zu erhalten und zugleich die Antwortzeiten spürbar zu verkürzen. Ausgabetokens sind Textbausteine, aus denen die generierten Antworten bestehen. OpenAI betonte, dass Echtzeit‑Performance bislang oft den Einsatz kleinerer oder stark spezialisierter Modelle erforderte, während Ultrafast auf „mehr nutzbringende Arbeit pro Sekunde“ abzielt.

Unter den Anwendungsfeldern, die laut OpenAI besonders profitieren dürften, nennt das Unternehmen Incident‑Response, Finanzanalyse, Kundenservice, E‑Commerce und Live‑Recherche. Ingenieure können den Modus nutzen, um während eines laufenden Ausfalls Logs, Traces und jüngste Codeänderungen zu untersuchen, während Support‑Systeme mehrschrittige Anfragen in laufenden Gesprächen abwickeln können.

Außerdem lesenswert: Anthropic strebt 6‑Mrd.-$‑Decart‑Deal an und bereitet Börsengang vor

Auswirkungen von GPT‑5.6 Sol

Frühe Unternehmenskunden berichten, dass die höhere Geschwindigkeit die Rolle des Modells in interaktiven Workflows grundlegend verändert. John Crepezzi vom Handelshaus Jane Street bezeichnete den Leistungszuwachs als „beeindruckend“ und erklärte, dies mache fokussierte Arbeit Seite an Seite mit Modellen deutlich praktikabler.

Courtland Lykins, Produktverantwortlicher für Voice‑AI bei Podium, erklärte, Ultrafast sei ein wichtiger Baustein im Voice‑Stack des Unternehmens, da „die Geschwindigkeit das gesamte Anruferlebnis“ bei komplexeren Vorgängen verändere. OpenAI betonte zudem, dass Finanzanalysten mit dem Modus Marktbewegungen und Transaktionen analysieren können, ohne auf langsamere Batch‑Verarbeitung angewiesen zu sein – ein Szenario, das stark von schnell wechselnden Eingangsdaten abhängt.

Die Preview ist derzeit eher durch Infrastrukturgrenzen als durch eine breite öffentliche Einführung limitiert. OpenAI nutzt nach eigenen Angaben Feedback der ersten Unternehmenskunden, um zu bestimmen, in welchen Workloads der Geschwindigkeitsvorteil den größten Mehrwert stiftet, bevor der Zugang ausgeweitet wird.

Die Verbindung zu Cerebras reicht über Ultrafast hinaus. OpenAI hatte im Januar eine Partnerschaft mit dem Chipentwickler verkündet, um seiner Plattform 750 Megawatt an latenzarmer KI‑Rechenleistung hinzuzufügen. Bereits im Februar wurde GPT‑5.3‑Codex‑Spark als erstes Modell aus dieser Kooperation eingeführt und nutzte Cerebras‑Hardware, um bei Echtzeit‑Coding mehr als 1.000 Tokens pro Sekunde zu erreichen.

Als Nächstes lesen: Handelsvolumen von Virtuals Protocol schießt um 180 % in die Höhe, Bullen peilen 0,68 $ an

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev ist Head of Content bei Yellow.com und berichtet seit 10 Jahren über Krypto. Er ist auf tiefgehende Research- und Learn-Artikel spezialisiert, mit Schwerpunkt auf analytischer Berichterstattung, Branchenkontext und den größeren Kräften, die den Kryptomarkt prägen – von der KI-Ära und Sicherheitstechnologien bis hin zu Innovationen im Fintech-Bereich. Er ist überzeugt, dass alles Digitale in naher Zukunft alles Analoge überholen wird, und arbeitet intensiv daran, dies Wirklichkeit werden zu lassen.

Haftungsausschluss und Risikowarnung: Die in diesem Artikel bereitgestellten Informationen dienen nur Bildungs- und Informationszwecken und basieren auf der Meinung des Autors. Sie stellen keine Finanz-, Anlage-, Rechts- oder Steuerberatung dar. Kryptowährungsassets sind hochvolatil und unterliegen hohen Risiken, einschließlich des Risikos, Ihre gesamte oder einen erheblichen Teil Ihrer Investition zu verlieren. Der Handel oder das Halten von Krypto-Assets ist möglicherweise nicht für alle Anleger geeignet. Die in diesem Artikel geäußerten Ansichten sind ausschließlich die des Autors/der Autoren und repräsentieren nicht die offizielle Politik oder Position von Yellow, seinen Gründern oder seinen Führungskräften. Führen Sie immer Ihre eigenen gründlichen Recherchen (D.Y.O.R.) durch und konsultieren Sie einen lizenzierten Finanzprofi, bevor Sie eine Anlageentscheidung treffen.
OpenAI beschleunigt GPT-5.6 Sol um das 14‑Fache mit neuem Ultrafast‑Modus | Yellow