Google 周三推出 Gemini 3.8 Flash,新版在獨立智能指數拿下 59 分,成本僅為多款前沿旗艦模型的一小部分,同時再加推一個設有限制的網絡安全特化版本。
要點速覽:
- Gemini 3.8 Flash 在 Artificial Analysis Intelligence Index(人工分析智能指數)取得 59 分,比三星期前推出的前一版高 3 分。
- 代幣價格維持至 12 月 31 日:每百萬輸入代幣 0.75 美元、每百萬輸出代幣 3.75 美元,但每個任務實際成本較上一版高約 40%。
- 網絡安全專用版本只透過全新 Fairwind Program,供已審核的政府、關鍵基建營運商及軟件維護方使用。
Gemini 3.8 Flash 基準測試表現
Google 已於 9 月 2 日公佈兩個版本,這是六星期內第三次更新 Flash 系列。兩者同樣建基於一個核心系統,訓練數據中大比例集中於網絡安全相關工作。
其中一個版本主打編碼及智能代理場景;另一個則在嚴格的存取規則下,用於大規模程式碼庫中尋找軟件漏洞。
在高推理設定下,模型在 Artificial Analysis Intelligence Index 的得分達 59 分,比 3.7 Flash 高 3 分,與 GPT-5.6 Sol 及 Grok 4.6 看齊。它在 HLE-Verified 多步推理測試(涵蓋科學、人文及專業範疇)亦錄得 54.9% 表現。Google 指出,長週期軟件工程場景是今次進步最明顯的方向。
定價方面,Google 宣布在今年底前維持早鳥價:每百萬輸入代幣 0.75 美元、每百萬輸出代幣 3.75 美元。到元旦起,這兩個價位將同步加倍。
延伸閱讀:Claude Fable 5.1 亮相:支援 0.25 美元快取讀取並加入防抄襲控制
為何 Gemini 每個任務反而更貴?
代幣更便宜,不代表整體算力帳單會下降。以基準測試計算,Gemini 3.8 Flash 每個任務平均成本約 0.58 美元,比前一代高出約 40%。主因在於平均輸出長度增加約 30%,升至約 48,000 代幣,而且智能代理任務需要更多回合互動。
競爭對手 Anthropic 的旗艦模型,在同類任務上的平均成本接近 Google 的六倍,令 Gemini 仍處於行業成本最前沿。
Google 產品高級總監 Tulsee Doshi 及 DeepMind 網絡安全負責人 Raluca Ada Popa 解釋,模型「工作更勤力」:增加推理步驟、重複調用工具,以換取更高質素的輸出。希望維持舊成本結構的團隊,可繼續使用 3.7 Flash;而 Pro 及 Ultra 用戶則可透過 Gemini App、AI Mode 及 Google Sheets 直接使用最新版本。
Fairwind Program 收緊網安模型門檻
針對網絡安全的特化版本,則被鎖在全新的 Fairwind Program 之後,只向通過審核的政府機構、關鍵基建營運商及軟件維護團隊開放。
在一個涵蓋 20 種編程語言的內部測試中,該模型在漏洞檢出上的成功率超過 70%。Google 表示,其 Chrome 安全部門借助這個系統,產生的正確修補程式數量是多個體量更大的商用競品的 2.6 倍。一支雲端研究團隊亦曾用它在兩小時內鎖定一個關鍵漏洞,而這類工作以往往往需要數月時間。
高頻率更新背後,是 Google AI 部門剛走過一段「失速期」——原訂 6 月推出的 Gemini 3.5 Pro 未能如期面世。
8 月初,Demis Hassabis 宣布卸任 DeepMind 行政總裁,轉任主席一職;而 Koray Kavukcuoglu 則接手營運,但職銜只有高級副總裁,被市場解讀為權力下調。





