Elon Musk 表示,SpaceXAI 計劃在 8 月 7 日前後推出 Grok 4.6,其後數星期內再發布 Grok 4.7,一個參數規模達 2.1 兆的更大型模型。
重點摘要:
- Grok 4.6 目標在約 8 月 7 日上線,Grok 4.7 則會在其後數星期推出。
- 後者是一款 2.1 兆參數模型,回應速度較慢,但完成同樣任務時所需代幣更少。
- 時間點正值 Kimi K3 權重剛剛開源,以及 Anthropic 推出 Claude Opus 5 之後數日。
Grok 4.6 料 8 月初登場
Musk 週二在 X 上披露 時程,形容 Grok 4.6 相比現有版本,加入明顯更重的監督式微調及強化學習。
他預計 Grok 4.6 會在約 8 月 7 日上線,至於 Grok 4.7 則會在數星期後接力推出。Musk 強調,除回應速度外,Grok 4.7 在各方面均屬升級版本。
他解釋,即使模型回應較慢,處理同一批工作時,仍可用更少代幣完成,這亦是 SpaceXAI 自春季以來持續強調的「效率說」。
不過,這個「2.1 兆」參數數字,與他早前的說法略有矛盾。Musk 7 月 18 日確認 Grok 4.6 訓練時間表時,曾表示該型號本身就是一個 2 兆參數模型。
延伸閱讀: Crypto 扳手搶劫半年錄 52 宗,大多發生於法國
Kimi K3 基準測試成 Grok 比較背景
發布時機頗為關鍵。月之暗面 Moonshot AI 公開 Kimi K3 全部權重 的時間是本週一,該模型規模達 2.8 兆參數,而 Anthropic 亦在三日前剛推出 Claude Opus 5。根據 Artificial Analysis 的評分,Kimi K3 在智能指數上得分 57,Grok 4.5 則為 54;但在成本上,較細的 Grok 4.5 每個任務約需 0.31 美元,遠低於 Kimi K3 約 0.94 美元的成本。
Vercel 行政總裁 Guillermo Rauch 表示,該公司最新內部測試顯示,在網絡安全場景的「性價比」上,Grok 4.5 仍排第一,表現貼近 Kimi K3,但成本卻只有 Claude Opus 5 的一小部分。他同時指出,OpenAI 的 Sol 模型仍被視為當前前沿水準,整體領先於 Anthropic 的最新版本。
價格與排名之間的落差,正是 SpaceXAI 的核心賣點。相關測試顯示,Grok 4.5 在解決同一組軟件工程問題時,所輸出代幣大約只有 Claude Opus 4.8 的四分之一,相應成本 亦大幅降低。
Musk 對 Grok 的說法 7 月內多次變陣
週二的這則貼文,可說為 7 月以來一連串變動中的最新版本。SpaceXAI 在 7 月 8 日推出 Grok 4.5,定價為每百萬輸入代幣 2 美元、每百萬輸出代幣 6 美元,約為 Anthropic 對 Opus 4.8 收費的一半以下。
Musk 當時形容 Grok 4.5 大致相當於「一年前的 Claude 旗艦」水準,其後又在 7 月 24 日向追隨者表示,Grok 4.6 需時約兩星期,Grok 4.7 則約四星期後上線。
不過,這些說法全都只在 X 上釋出,並非透過正式的模型卡或技術文件發布。對兩個尚未公開的型號,SpaceXAI 暫未提供任何明確規格、定價、上下文長度或基準測試結果。Musk 過去亦多次未能如期達到自己訂下的 AI 相關時限,而目前兩個版本都仍未有官方發布頁面。





