OpenAI heeft Ultrafast geïntroduceerd, een nieuwe preview-servicelaag die GPT-5.6 Sol tot 14 keer sneller laat draaien dan de standaardmodus en tot 750 outputtokens per seconde kan genereren.
Belangrijkste punten:
- Ultrafast laat GPT-5.6 Sol tot 14 keer sneller draaien dan de standaardverwerking.
- Cerebras levert de rekenkracht achter de modus, goed voor maximaal 750 outputtokens per seconde.
- De dienst is beschikbaar als gelimiteerde preview; bredere uitrol volgt naarmate de capaciteit toeneemt.
OpenAI Ultrafast-preview
OpenAI maakte Ultrafast op 13 augustus bekend. De snelheidsgerichte laag wordt eerst via de API aangeboden aan een beperkte groep klanten. Het bedrijf geeft aan dat de toegang wordt opgeschaald zodra de infrastructuur dat toelaat.
De dienst draait op technologie van Cerebras en is opgezet om de capaciteiten van GPT-5.6 Sol te behouden, terwijl de responstijd drastisch wordt verlaagd. Outputtokens zijn fragmenten gegenereerde tekst. Volgens OpenAI vereiste quasi realtime gebruik tot nu toe meestal een kleiner of meer gespecialiseerd model, terwijl Ultrafast mikt op “meer nuttig werk per seconde”.
OpenAI rekent incidentrespons, financieel onderzoek, klantenservice, e‑commerce en live research tot de workflows die naar verwachting het meeste profiteren. Engineers kunnen de modus gebruiken om logs, traces en recente codewijzigingen door te lichten terwijl een storing nog gaande is, terwijl supportsystemen meerstapsverzoeken kunnen afhandelen tijdens live gesprekken.
Zie ook: Anthropic jaagt op $6 mrd Decart-deal en maakt zich op voor beursgang
Impact van GPT-5.6 Sol
Vroege klanten geven aan dat de hogere snelheid de rol van het model in interactief werk fundamenteel verandert. John Crepezzi van Jane Street noemt de snelheidswinst “indrukwekkend” en stelt dat gericht samenwerken met modellen daarmee veel praktischer wordt.
Courtland Lykins, productverantwoordelijke voor spraak-AI bij Podium, zegt dat Ultrafast veel waarde toevoegt aan de voice-stack van het bedrijf, omdat “de snelheid de beleving van telefoongesprekken volledig verandert” bij complexe gesprekken. OpenAI benadrukt dat financiële analisten hierdoor wisselende marktsignalen en transacties kunnen doorrekenen zonder te hoeven wachten op trage batchverwerking – cruciaal bij snel veranderende inputdata.
De preview wordt voorlopig beperkt door de onderliggende infrastructuur en is nog geen brede publieke lancering. OpenAI zegt de feedback van de eerste klanten te gebruiken om te bepalen in welke gebruiksscenario’s de snelheidswinst het meeste waarde oplevert, voordat de dienst verder wordt opengesteld.
De samenwerking met Cerebras gaat verder terug dan Ultrafast. OpenAI kondigde in januari een partnerschap met de chipfabrikant aan om 750 megawatt aan low-latency AI-rekenkracht toe te voegen aan zijn platform. In februari werd GPT-5.3-Codex-Spark het eerste model binnen die samenwerking: dankzij Cerebras-hardware wist het in realtime coding meer dan 1.000 tokens per seconde te halen.
Lees verder: Handelsvolume Virtuals Protocol schiet 180% omhoog, bulls mikken op $0,68





