OpenAI introduceert Ultrafast, een nieuwe preview-servicelaag die GPT-5.6 Sol tot veertien keer sneller laat draaien dan de standaardmodus en tot 750 outputtokens per seconde kan genereren.
Belangrijkste punten:
- Ultrafast laat GPT-5.6 Sol tot 14 keer sneller draaien dan standaardverwerking.
- Cerebras levert de rekenkracht achter deze modus, goed voor tot 750 outputtokens per seconde.
- De dienst is beschikbaar als beperkte preview; bredere toegang volgt naarmate de capaciteit wordt opgeschaald.
OpenAI Ultrafast-preview
OpenAI kondigde Ultrafast op 13 augustus aan. De snelheidsgerichte servicelaag wordt eerst via de API uitgerold naar een beperkte groep klanten. Het bedrijf geeft aan dat de toegang stapsgewijs wordt uitgebreid naarmate de onderliggende infrastructuur meegroeit.
De dienst draait op technologie van Cerebras en is ontworpen om de volledige capaciteiten van GPT-5.6 Sol te behouden, terwijl de tijd tot een bruikbaar antwoord fors wordt teruggebracht. Outputtokens zijn de bouwstenen van de gegenereerde tekst. Volgens OpenAI vereiste near-realtime gebruik tot nu toe vaak een kleiner of meer gespecialiseerd model, terwijl Ultrafast juist mikt op “meer nuttig werk per seconde”.
OpenAI ziet onder meer incidentrespons, financieel onderzoek, klantenservice, e‑commerce en live research als workflows die het meest profiteren. Engineers kunnen de modus inzetten om logbestanden, traces en recente codewijzigingen te analyseren terwijl een storing nog bezig is, terwijl supportsystemen meerstapsverzoeken kunnen afhandelen tijdens lopende klantgesprekken.
Ook interessant: Anthropic jaagt op $6 mrd Decart-deal en maakt zich op voor beursgang
Impact van GPT-5.6 Sol
Vroege gebruikers stellen dat de snelheid de manier verandert waarop het model in interactieve werkzaamheden kan worden ingebed. John Crepezzi van Jane Street noemt de versnelling “indrukwekkend” en zegt dat gericht samenwerken met modellen hierdoor een stuk praktischer wordt.
Courtland Lykins, productverantwoordelijke voor voice-AI bij Podium, stelt dat Ultrafast veel waarde toevoegt aan de voice‑stack van het bedrijf omdat “de snelheid de hele belervaring verandert” bij complexe gesprekken. Ook meldt OpenAI dat financiële analisten met Ultrafast wisselende marktsignalen en transacties kunnen doorlichten zonder de vertraging van klassieke batchverwerking — cruciaal bij sterk fluctuerende inputdata.
De preview wordt voorlopig begrensd door de beschikbare infrastructuur; een brede publieke uitrol is nog niet aan de orde. OpenAI zegt de feedback van de eerste klanten te gebruiken om te bepalen in welke usecases de extra snelheid de meeste waarde toevoegt, voordat de dienst breder beschikbaar komt.
De samenwerking met Cerebras loopt vooruit op Ultrafast. OpenAI kondigde in januari een partnerschap met de chipfabrikant aan om 750 megawatt aan low‑latency AI‑rekenkracht toe te voegen aan zijn platform. In februari werd GPT-5.3-Codex-Spark het eerste model binnen die samenwerking: door gebruik te maken van Cerebras‑hardware overschreed het in realtime codeertoepassingen de grens van 1.000 tokens per seconde.
Lees ook: Virtuals Protocol-handelsvolume schiet 180% omhoog, bulls mikken op $0,68





