OpenAI 推出 Ultrafast 模式 GPT-5.6 Sol 速度最高提升 14 倍

New Ultrafast mode pushes GPT-5.6 Sol to 14x standard processing speed (Image: Shutterstock)
New Ultrafast mode pushes GPT-5.6 Sol to 14x standard processing speed (Image: Shutterstock)

OpenAI 公布全新 Ultrafast 預覽服務級別,支援以 GPT-5.6 Sol 為核心的超高速推理,官方指其輸出速度較標準模式最高快 14 倍,每秒最多可產生約 750 個輸出 tokens。

重點摘要:

  • Ultrafast 模式下,GPT-5.6 Sol 推理速度較標準處理最高提升約 14 倍。
  • 模式由 Cerebras 提供算力支援,每秒可輸出高達約 750 個 tokens。
  • 服務現階段屬限量預覽,OpenAI 表示會隨運算容量擴充逐步開放。

Ultrafast 限量預覽詳情

OpenAI 於 8 月 13 日公布 Ultrafast,並率先透過其 API 向小部分企業客戶開放,以高速為主打的新層級會隨容量增加而擴大覆蓋。

這項服務由 Cerebras 提供底層運算,按 OpenAI 描述,是專為 在維持 GPT-5.6 Sol 功能表現的前提下,大幅縮短回應生成時間而設計。所謂輸出 tokens,即模型生成文字的最小單位。OpenAI 指出,以往如要追求近乎即時的互動速度,往往要退而求其次,改用較細或較專門的模型;Ultrafast 則是嘗試在「每秒完成更多實際工作」上取得突破。

OpenAI 預計,事故應變、金融研究、客戶服務、電商營運及實時研究等工作流程,會最先受惠。工程團隊可在系統事故發生期間,利用 Ultrafast 審視即時日誌、traces 及最新程式碼變更;客服系統則有能力在通話期間處理多步驟、較複雜的查詢。

延伸閱讀:Anthropic 爭取 60 億美元 Decart 融資 同步籌備上市

GPT-5.6 Sol 的應用影響

早期企業用戶認為,加速之後,模型能更自然地嵌入互動式工作流程之中。Jane StreetJohn Crepezzi 形容性能提升「相當驚人」,並指出這令與模型並肩專注工作的可行性大增。

Podium 語音 AI 產品主管 Courtland Lykins 表示,Ultrafast 對公司語音技術堆疊幫助明顯,「速度完全改變了複雜通話的體驗」。OpenAI 補充,金融研究人員可在市場訊號、交易數據不斷變化之際,進行即時分析,而毋須再依賴較慢的批次處理;這類用例高度倚重快速更新的輸入數據。

不過,預覽階段現時主要受制於基建容量,而非法規或策略性封測。OpenAI 指出,會先吸收首批企業客戶的實際使用反饋,評估在哪些場景下速度提升最能創造價值,之後才會再擴大開放。

OpenAI 與 Cerebras 的合作早於 Ultrafast 前已展開。OpenAI 今年 1 月宣布與這家晶片商結盟,計劃為其平台新增約 750 兆瓦、低延遲的 AI 運算資源。到 2 月,GPT-5.3-Codex-Spark 成為首個落實於該合作上的模型,透過 Cerebras 硬件,在即時編碼場景中把輸出速度推高至每秒逾 1,000 個 tokens。

下篇看什麼:Virtuals Protocol 交易量飆升 180% 多頭目標劍指 0.68 美元

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev 現任 Yellow.com 的內容主管,過去 10 年一直專注報導加密貨幣相關議題。他擅長撰寫深入的研究與學習類文章,重點放在分析式報導、產業背景脈絡,以及塑造加密貨幣領域的宏觀力量,從 AI 時代與安全技術到金融科技創新等面向。他相信所有數碼事物將在不久的將來全面超越一切類比事物,並正為實現這個願景而全力以赴。

免責聲明及風險提示: 本文資訊僅供教育與參考之用,並基於作者意見,並不構成金融、投資、法律或稅務建議。 加密貨幣資產具高度波動性並伴隨高風險,可能導致投資大幅虧損或全部損失,並非適合所有投資者。 文章內容僅代表作者觀點,不代表 Yellow、創辦人或管理層立場。 投資前請務必自行徹底研究(D.Y.O.R.),並諮詢持牌金融專業人士。