OpenAI wprowadziło Ultrafast – nowy, podglądowy poziom usługi, w ramach którego GPT-5.6 Sol działa nawet 14 razy szybciej niż w standardowym trybie i generuje do 750 tokenów wyjściowych na sekundę.
Najważniejsze informacje:
- Ultrafast przyspiesza GPT-5.6 Sol nawet 14-krotnie względem standardowego przetwarzania.
- Tryb napędza Cerebras, umożliwiając generowanie do 750 tokenów na sekundę.
- Usługa jest dostępna w ograniczonym podglądzie; szerszy dostęp ma się pojawiać wraz z rozbudową mocy obliczeniowych.
OpenAI Ultrafast – podgląd usługi
OpenAI ogłosiło start Ultrafast 13 sierpnia, uruchamiając nowy, „szybkościowy” poziom najpierw w API, dla wybranej grupy klientów. Firma zapowiada, że dostęp będzie stopniowo rozszerzany wraz ze wzrostem dostępnej przepustowości.
Usługa bazuje na infrastrukturze Cerebras i jest projektowana, by zachować pełne możliwości GPT-5.6 Sol przy wyraźnym skróceniu czasu generowania odpowiedzi. Tokeny wyjściowe to jednostki generowanego tekstu. OpenAI zwróciło uwagę, że dotychczas osiągnięcie pracy zbliżonej do czasu rzeczywistego zwykle wymagało wyboru mniejszego lub silnie wyspecjalizowanego modelu, podczas gdy Ultrafast ma dostarczać „więcej użytecznej pracy na sekundę”.
Według OpenAI, największymi beneficjentami nowego trybu mają być m.in. obsługa incydentów, analizy finansowe, wsparcie klienta, handel online i badania prowadzone na żywo. Inżynierowie mogą wykorzystać Ultrafast do przeglądu logów, śladów i najnowszych zmian w kodzie w trakcie trwania awarii, a systemy wsparcia – do obsługi wieloetapowych zapytań w czasie rzeczywistej rozmowy.
Zobacz także: Anthropic stara się o umowę Decart wartą 6 mld dol., szykując się do debiutu giełdowego
Znaczenie GPT-5.6 Sol
Pierwsi klienci podkreślają, że wzrost prędkości zmienia sposób, w jaki model można wkomponować w pracę interaktywną. John Crepezzi z Jane Street nazwał poprawę „imponującą” i stwierdził, że ułatwia ona skoncentrowaną pracę „ramię w ramię” z modelami.
Courtland Lykins, szef produktu ds. voice AI w Podium, ocenił, że Ultrafast znacząco wzmacnia stos technologii głosowych spółki, ponieważ „prędkość całkowicie zmienia doświadczenie rozmowy” przy złożonych zadaniach. OpenAI dodaje, że analitycy finansowi mogą szybciej przetwarzać zmieniające się sygnały rynkowe i transakcje, zamiast czekać na wolniejsze przetwarzanie wsadowe. Tego typu scenariusze opierają się na szybko aktualizujących się danych wejściowych.
Faza podglądowa jest ograniczona przede wszystkim dostępną infrastrukturą, a nie decyzją o szerokim, publicznym debiucie. OpenAI podkreśla, że wykorzystuje opinie początkowych użytkowników, by zidentyfikować obszary, w których przyspieszenie daje największą wartość, zanim otworzy usługę na większą skalę.
Współpraca z Cerebras wyprzedza sam Ultrafast. OpenAI już w styczniu ogłosiło partnerstwo z producentem układów, którego celem jest dodanie 750 MW niskolatencyjnej mocy obliczeniowej AI do platformy firmy. W lutym model GPT-5.3-Codex-Spark jako pierwszy wykorzystał tę współpracę, korzystając ze sprzętu Cerebras, by przekroczyć barierę 1000 tokenów na sekundę w zastosowaniach kodowania w czasie rzeczywistym.
Czytaj dalej: Wolumen obrotu Virtuals Protocol rośnie o 180%, byki celują w 0,68 dol.





