OpenAI представила Ultrafast — попередній сервісний рівень, що дозволяє запускати GPT-5.6 Sol до 14 разів швидше за стандартний режим і генерувати до 750 вихідних токенів за секунду.
Основне:
- Ultrafast розганяє GPT-5.6 Sol до 14 разів порівняно зі стандартною обробкою.
- Режим працює на інфраструктурі Cerebras і забезпечує до 750 вихідних токенів за секунду.
- Сервіс доступний у форматі обмеженого попереднього доступу, з подальшим розширенням у міру нарощування потужностей.
Попередній доступ OpenAI Ultrafast
OpenAI оголосила про Ultrafast 13 серпня, запустивши новий високошвидкісний рівень спершу через API для обмеженого кола клієнтів. У компанії зазначають, що доступ розширюватимуть паралельно зі зростанням обчислювальних ресурсів.
Сервіс працює на рішеннях Cerebras і створений так, аби зберегти можливості GPT-5.6 Sol, суттєво скоротивши час отримання відповіді. Вихідні токени — це фрагменти згенерованого тексту. Раніше для досягнення майже «живої» взаємодії користувачі змушені були переходити на менші або вузькоспеціалізовані моделі. Ultrafast натомість орієнтований на «більше корисної роботи за секунду».
OpenAI розглядає як ключові сценарії використання реагування на інциденти, фінансові дослідження, клієнтську підтримку, електронну комерцію та дослідження в реальному часі. Інженери можуть застосовувати режим для аналізу логів, трейсів і останніх змін у коді прямо під час інциденту, а системи підтримки — обробляти багатокрокові запити в ході живого діалогу з клієнтом.
Також читайте: Anthropic залучає угоду Decart на $6 млрд і готується до IPO
Вплив GPT-5.6 Sol
Перші корпоративні користувачі зазначають, що швидкість кардинально змінює роль моделі в інтерактивних робочих процесах. Джон Крепецці з Jane Street назвав зростання продуктивності «вражаючим» і підкреслив, що воно робить спільну з моделлю зосереджену роботу значно практичнішою.
Кортленд Лайкінс, керівник напрямку голосового AI у Podium, зазначив, що Ultrafast став критично важливим для голосового стека компанії, оскільки «швидкість кардинально змінює досвід дзвінка» у складних сценаріях. OpenAI додає, що фінансові аналітики можуть відслідковувати зміни ринкових сигналів і транзакцій без затримок, характерних для пакетної обробки. Цей кейс напряму залежить від здатності моделі працювати з динамічно змінними вхідними даними.
Наразі попередній доступ обмежений саме інфраструктурою, а не готовністю до масового публічного запуску. У OpenAI зазначають, що використовують зворотний зв’язок від перших клієнтів, щоб сфокусувати розширення доступу на тих сценаріях, де висока швидкість дає максимальний економічний ефект.
Співпраця з Cerebras розпочалася ще до запуску Ultrafast. У січні OpenAI оголосила про партнерство з виробником чипів, спрямоване на додавання 750 МВт низьколатентних обчислювальних потужностей AI до своєї платформи. У лютому GPT-5.3-Codex-Spark став першим продуктом цієї співпраці: модель, що використовує апаратне забезпечення Cerebras, перевищила поріг у 1 000 токенів за секунду в режимі реального часу для задач програмування.
Читайте далі: Обсяг торгів Virtuals Protocol злетів на 180%, «бики» націлюються на $0,68





