OpenAI公布全新預覽服務層級「Ultrafast」,支援其前沿模型 GPT-5.6 Sol, 相比標準模式處理速度最高可提升14倍,輸出速度可達每秒約750個token。
亮點重點:
- Ultrafast令GPT-5.6 Sol運算速度較標準處理最高快14倍。
- 模式由Cerebras提供算力支援,實現每秒最多約750個輸出token。
- 目前屬限量預覽階段,會按基建擴充逐步放寬使用門檻。
OpenAI Ultrafast預覽詳情
OpenAI於8月13日公布Ultrafast, 率先透過API向少量客戶提供這一主打速度的全新層級,並指會隨著算力容量增加, 逐步擴大可接入客戶範圍。
Ultrafast由Cerebras提供底層硬件支援,並設計 以保留GPT-5.6 Sol原有能力,同時大幅縮短生成回應所需時間。所謂output token, 指的是模型生成文字的基本單位。OpenAI指出,以往若要接近「實時」表現, 用戶往往要犧牲模型體積或功能,改用較小或較窄用途的模型;Ultrafast則以 「每秒完成更多實用工作」為目標,嘗試在性能和速度之間取得平衡。
OpenAI預期,事故應變、金融研究、客戶服務、電商及即時研究等工作流程, 將是最受惠的場景。以工程團隊為例,可在系統事故仍在發生期間, 即時調用Ultrafast快速分析log、追蹤trace及審視最新程式碼變更; 客戶支援系統則可在真人對話進行期間,處理多步驟、具邏輯鏈的複雜查詢。
延伸閱讀:Anthropic爭取60億美元Decart融資交易 同時部署IPO計劃
GPT-5.6 Sol加速效應
早期企業用戶表示,速度升級顯著改變模型在互動式工作流程中的定位。 量化交易公司Jane Street的John Crepezzi形容,性能提升「相當驚人」, 令人機協作進行高專注度工作變得更可行。
Podium語音AI產品負責人Courtland Lykins則指,Ultrafast對公司語音技術堆疊 帶來明顯價值,因為「速度完全改變了複雜通話的體驗」。OpenAI補充, 金融研究人員可利用Ultrafast,實時分析快速變化的市場訊號與交易數據, 毋須再依賴傳統批次處理流程,減少因等待而錯失時機的風險。該用例高度依賴 對瞬息萬變輸入數據的即時反應能力。
目前Ultrafast仍受基建資源所限,未有全面向公眾開放。OpenAI表示, 正透過首批企業用戶的實際反饋,判斷在哪些工作場景中,極速模式能創造 最大邊際價值,再決定如何擴展覆蓋面。
OpenAI與Cerebras的合作關係早於Ultrafast之前已經展開。OpenAI今年1月宣布 與該晶片商結盟,計劃為平台新增約750MW低延遲AI運算能力;其後在2月推出的 GPT-5.3-Codex-Spark,成為首個倚重該合作架構的模型,藉Cerebras硬件, 在即時編碼場景下輸出速度突破每秒1,000個token。





