OpenAI представила Ultrafast — попередній сервісний рівень, який дозволяє GPT-5.6 Sol працювати до 14 разів швидше за стандартний режим і генерувати до 750 вихідних токенів за секунду.
Головне:
- Ultrafast прискорює GPT-5.6 Sol до 14 разів порівняно зі стандартною обробкою.
- Режим працює на інфраструктурі Cerebras і здатен видавати до 750 вихідних токенів за секунду.
- Сервіс доступний у форматі обмеженого попереднього перегляду, розширення доступу очікується зі зростанням потужностей.
Попередній запуск OpenAI Ultrafast
OpenAI оголосила про Ultrafast 13 серпня, запустивши цей «швидкісний» тариф спершу через API для обмеженого кола клієнтів. У компанії зазначають, що з розширенням інфраструктури доступ поступово масштабуватиметься.
Сервіс працює на рішеннях Cerebras і спроєктований так, щоб зберегти можливості GPT-5.6 Sol, водночас суттєво скоротивши час формування відповідей. Вихідні токени — це фрагменти згенерованого тексту. За словами OpenAI, раніше для роботи, максимально наближеної до реального часу, користувачам часто доводилося обирати менші або вузькоспеціалізовані моделі, тоді як Ultrafast орієнтується на «більше корисної роботи за секунду».
Серед ключових сценаріїв, які, за оцінкою OpenAI, найбільше виграють від Ultrafast, — реагування на інциденти, фінансові дослідження, підтримка клієнтів, електронна комерція та оперативна аналітика. Інженери можуть використовувати режим для аналізу логів, трейсів і останніх змін у коді в розпал інциденту, а системи підтримки — опрацьовувати багатокрокові запити просто під час живої розмови.
Читайте також: Anthropic готує угоду з Decart на $6 млрд і планує IPO
Вплив GPT-5.6 Sol
Перші корпоративні клієнти зазначають, що нова швидкість кардинально змінює роль моделі в інтерактивних робочих процесах. Джон Крепецці з Jane Street назвав прискорення «вражаючим» і підкреслив, що воно робить спільну з моделлю зосереджену роботу значно практичнішою.
Кортланд Лайкінс, продакт-лід з голосового ШІ у Podium, пояснив, що Ultrafast став критичним елементом голосового стеку компанії, оскільки «швидкість повністю змінює досвід дзвінка» під час опрацювання складних завдань. OpenAI додає, що фінансові аналітики можуть оперативно опрацьовувати змінні ринкові сигнали й транзакції без затримок, характерних для повільніших пакетних процесів. Успішність такого кейсу залежить від максимально швидкої обробки вхідних даних.
Попередній запуск наразі обмежений інфраструктурними можливостями, а не орієнтований на масовий публічний реліз. В OpenAI зазначають, що використовують відгуки перших корпоративних користувачів, щоб зрозуміти, у яких сценаріях додаткова швидкість створює найбільшу цінність, і вже потім розширювати доступність сервісу.
Співпраця з Cerebras почалася ще до Ultrafast. У січні OpenAI оголосила партнерство з виробником чипів, щоб додати до своєї платформи 750 мегаватів низьколатентних обчислень для ШІ. У лютому модель GPT-5.3-Codex-Spark стала першим продуктом у межах цієї співпраці: завдяки апаратним рішенням Cerebras вона досягла швидкості понад 1 000 токенів за секунду в реальному часі під час написання коду.
Читати далі: Обсяги торгів Virtuals Protocol зросли на 180%, «бики» цілять у $0,68





