OpenAI представила Ultrafast — новый предпросмотровый сервисный уровень, в рамках которого GPT-5.6 Sol работает до 14 раз быстрее стандартного режима и выдает до 750 токенов в секунду.
Ключевые факты:
- Ultrafast разгоняет GPT-5.6 Sol до 14 раз по сравнению со стандартной обработкой.
- За режим отвечает инфраструктура Cerebras, обеспечивающая до 750 токенов вывода в секунду.
- Сервис доступен в ограниченном предпросмотре, расширение доступа ожидается по мере наращивания мощностей.
Предпросмотр OpenAI Ultrafast
OpenAI объявила о запуске Ultrafast 13 августа, сначала открыв доступ к скоростному уровню через API для ограниченного круга клиентов. Компания подчеркнула, что по мере роста емкости инфраструктуры будет расширять доступ.
Режим работает на базе Cerebras и создан так, чтобы сохранить возможности GPT-5.6 Sol и при этом резко сократить время генерации ответов. Токены вывода — это фрагменты генерируемого текста. По словам OpenAI, ранее для работы, близкой к реальному времени, пользователям приходилось жертвовать мощностью и переходить на более компактные или узкоспециализированные модели. Ultrafast нацелен на «больше полезной работы в секунду».
В числе сценариев, которые, по оценке OpenAI, максимально выиграют от нового режима, — реагирование на инциденты, финансовая аналитика, клиентская поддержка, e-commerce и живые исследовательские сессии. Инженеры могут использовать Ultrafast для одновременного анализа логов, трассировок и последних изменений в коде во время инцидента, а системы поддержки — обрабатывать сложные многошаговые запросы прямо в ходе живого диалога с пользователем.
Также читайте: Anthropic готовит сделку с Decart на $6 млрд и собирается на биржу
Эффект GPT-5.6 Sol
Ранние клиенты отмечают, что рост скорости меняет роль модели в интерактивной работе. Джон Крепецци из Jane Street назвал прирост производительности «впечатляющим» и отметил, что это делает более реалистичной концентрацию на задачах в тесной связке с моделью.
Кортланд Лайкинс, продакт-лид по голосовому ИИ в Podium, заявил, что Ultrafast стал ключевым элементом голосового стека компании, поскольку «скорость полностью меняет опыт звонка» при работе со сложными запросами. В OpenAI добавляют, что финансовые аналитики могут отслеживать рыночные сигналы и транзакции в динамике, не дожидаясь медленной пакетной обработки. Этот сценарий критически зависит от быстрого обновления входящих данных.
Пока предпросмотр ограничен инфраструктурой, а не широтой аудитории. В OpenAI подчеркивают, что используют обратную связь от первых компаний-клиентов, чтобы понять, где именно ускорение дает максимальную отдачу, и лишь затем расширять доступ.
Партнерство с Cerebras началось задолго до Ultrafast. В январе OpenAI объявила о сотрудничестве с чипмейкером для подключения к своей платформе 750 мегаватт низколатентных вычислительных мощностей под задачи ИИ. В феврале модель GPT-5.3-Codex-Spark стала первым продуктом в рамках этого альянса, использующим оборудование Cerebras для достижения скорости свыше 1 000 токенов в секунду в режиме реального времени при написании кода.
Читайте далее: Объем торгов Virtuals Protocol взлетел на 180%, быки метят в $0.68





