OpenAI представила Ultrafast — новый предварительный сервисный уровень, в котором GPT-5.6 Sol работает до 14 раз быстрее стандартного режима и выдает до 750 выходных токенов в секунду.
Ключевые факты:
- Ultrafast разгоняет GPT-5.6 Sol до 14 раз по сравнению со стандартной обработкой.
- За режимом стоит инфраструктура Cerebras, обеспечивающая до 750 выходных токенов в секунду.
- Сервис запущен в формате ограниченного превью, расширение доступа ожидается по мере роста мощностей.
Предварительный запуск OpenAI Ultrafast
OpenAI объявила о запуске Ultrafast 13 августа, сначала открыв скоростной тариф через API для ограниченного круга клиентов. В компании подчеркнули, что по мере наращивания мощностей доступ будет постепенно расширяться.
Режим работает на оборудовании Cerebras и разрабатывался так, чтобы сохранить функциональность GPT-5.6 Sol при существенном сокращении времени ответа. Токены вывода — это фрагменты генерируемого текста. По словам OpenAI, раньше для близкой к «реалтайму» работы пользователям приходилось выбирать более компактные или узкоспециализированные модели, тогда как Ultrafast ориентирован на «больше полезной работы в секунду».
Среди сценариев, которые, по ожиданиям компании, сильнее всего выиграют от Ultrafast, — инцидент-менеджмент, финансовая аналитика, служба поддержки, e-commerce и онлайн-исследования. Инженеры могут использовать режим для оперативного анализа логов, трейсов и свежих изменений в коде во время инцидентов, а системы поддержки — для обработки многошаговых запросов прямо в ходе живого диалога с клиентом.
Также читайте: Anthropic готовит сделку с Decart на $6 млрд и выход на биржу
Влияние GPT-5.6 Sol
Первые корпоративные пользователи отмечают, что прирост скорости меняет роль модели в интерактивной работе. Джон Крепецци из Jane Street назвал ускорение «впечатляющим» и отметил, что оно делает совместную фокусную работу с моделями намного более практичной.
Кортланд Лайкинс, руководитель продуктового направления голосового ИИ в Podium, заявил, что Ultrafast стал ключевым элементом голосового стека компании, поскольку «скорость полностью меняет опыт звонка» при решении сложных задач. В OpenAI добавили, что финансовые аналитики получают возможность отслеживать рыночные сигналы и транзакции без задержек, характерных для пакетной обработки. Такой сценарий особенно критичен при быстро меняющемся потоке данных.
Пока превью ограничено инфраструктурными возможностями, а не массовым публичным релизом. В OpenAI отмечают, что используют обратную связь от первых клиентов, чтобы понять, в каких случаях прирост скорости создает наибольшую ценность, и уже затем расширять доступ.
Партнерство с Cerebras началось еще до Ultrafast. В январе OpenAI объявила о сотрудничестве с производителем чипов, в рамках которого на платформу должно быть добавлено 750 мегаватт низколатентных вычислительных мощностей для ИИ. В феврале модель GPT-5.3-Codex-Spark стала первым результатом этой кооперации, выйдя на скорости свыше 1 000 токенов в секунду при работе с кодом в реальном времени благодаря оборудованию Cerebras.
Читайте далее: Торговый объем Virtuals Protocol взлетел на 180%, быки целятся в $0,68





