OpenAI 正式開放 GPT-5.6 系列,產品線明確劃分為高階的 Sol 與中價位的 Terra,兩者鎖定截然不同的運算與應用場景。
重點整理:
- Sol 單價為每百萬輸入 Token 5 美元、輸出 30 美元,是 Terra 的兩倍。
- Sol 在程式與「代理人」類基準測試中居冠,Terra 則主打日常工作、壓低成本。
- 早期測試顯示,在長時間任務下,Terra 的輸出 Token 消耗可能反而高於 Sol。
GPT-5.6:Sol 與 Terra 在定價策略上分道揚鑣
OpenAI 已於 7 月 9 日正式宣佈,將 GPT-5.6 全面上線至 ChatGPT、Codex 與 API,結束約兩週的限量預覽。旗艦款 Sol 鎖定高難度程式開發、資安任務與長時間代理人工作,OpenAI 將其定位為「史上最強程式模型」。Terra 則位居下一級,效能接近 GPT-5.5,但價格約砍半。
價格是兩者最明顯的分水嶺。Sol 每百萬輸入 Token 收費 5 美元、輸出 Token 為 30 美元;Terra 則為 2.5 美元與 15 美元。同系列第三款 Luna,則以每百萬輸入 1 美元、輸出 6 美元鎖定大規模、高頻量工作負載。
在 ChatGPT 的產品分層上,存取權也依此切割:付費訂閱用戶可在「中階推理」與「高階推理」設定中使用 Sol;而免費用戶與 Go 方案,則在 ChatGPT Work 與 Codex 內優先配給 Terra。GitHub 也已在 Copilot 中導入三款模型,並將 Sol 定位為處理大型程式碼庫與複雜推理的首選,Terra 則作為日常開發與代理式編碼的預設平衡解。
延伸閱讀:Charles Hoskinson 要離開 Cardano?他駁斥傳聞是徹頭徹尾的謊言
程式基準測試上,Sol 明顯領先 Terra
在 Artificial Analysis Coding Agent Index 上,Sol 取得 80 分,OpenAI 指出,這比 Anthropic 的 Claude Fable 5 高出 2.8 分。執行長 Sam Altman 更表示,Sol 在程式任務上的 Token 使用效率,較上一代自家模型提升 54%,明顯是對準企業 IT 預算開出的銷售話術。
不過成績並非全面壓制。Sol 在 SWE-Bench Pro 測試中僅獲 64.6%,仍落後約 15 個百分點給 Claude Mythos 5。獨立評測單位發現,雖然如此,Sol 在處理規模龐大且雜亂的程式碼庫時,仍能長時間維持在題上;相較之下,Terra 較適合範圍明確的實作任務與初步 Code Review,必要時再將案件升級交由 Sol 收尾。
同一批測試也對精打細算的團隊提出警訊:在長時間程式任務下,Terra 實際消耗的輸出 Token 數量,反而高於 Sol。換句話說,單價較低並不等同專案總成本較低,團隊應以「每個成功完成的任務成本」作為衡量指標,再決定是否將大量流量轉往 Terra。
此次分階段發表,也顯示 OpenAI 在前沿模型釋出策略上的明顯轉向。
公司在公開前,先就 GPT-5.6 系列的能力向美國政府進行簡報,並將早期測試名額限縮於一小圈經審核的合作夥伴,同步把這些合作對象名單告知官方。
這一代產品同時拋棄過往沿用的命名邏輯:數字改為代表「世代」,而 Sol、Terra、Luna 則被設計為可各自獨立演進的能力等級,未來得以在不同節奏上更新。






