Google 週三正式釋出 Gemini 3.8 Flash,新版模型在獨立智慧指標上拿下 59 分, 成本僅為多數旗艦對手的一小部分,並同步推出受限開放的網路安全版本。
重點整理
- Gemini 3.8 Flash 在 Artificial Analysis Intelligence Index 取得 59 分,比三週前推出的前一版高出 3 分。
- 直到 12 月 31 日前,輸入與輸出字元價格分別維持每百萬 0.75 與 3.75 美元,不過單一任務成本約比前代高出 4 成。
- 獨立的網路安全版本僅透過全新 Fairwind Program,提供給通過審核的政府單位、關鍵基礎設施營運商與軟體維護者使用。
Gemini 3.8 Flash 基準測試表現
Google 於 9 月 2 日公布兩種版本, 這是六週內第三次更新 Flash 系列;兩者皆建構在同一核心系統上,並大量以網路安全相關任務訓練。
一個版本主攻程式開發與 AI 代理工作流程,另一個則在嚴格存取管控下,針對大規模程式碼庫挖掘軟體漏洞。
在高推理模式下,新版模型於 Artificial Analysis Intelligence Index 的得分為 59 分, 比 3.7 Flash 高 3 分,與 GPT-5.6 Sol、Grok 4.6 同級。 在跨科學、人文與專業領域多步驟推理的 HLE-Verified 測試中,成績為 54.9%。Google 指出, 對於長週期軟體工程專案的處理,是本次提升最明顯的環節。
定價方面,Google 將導入期價格鎖定至 12 月 31 日: 輸入端每百萬 token 0.75 美元、輸出端每百萬 3.75 美元, 元旦起兩檔費率都將翻倍調漲。
延伸閱讀:Claude Fable 5.1 上線:快取讀取每百萬 0.25 美元、強化反抄襲控管
為何 Gemini 單一任務成本反而變貴?
純粹壓低 token 單價,並不保證實際任務整體更便宜。 以標準基準測試估算,Gemini 3.8 Flash 每項任務成本約為 0.58 美元, 比前一代高出約 40%,主因在於平均輸出長度增加約 3 成,達 4.8 萬 token, 且代理任務執行步驟更多。
不過,對手旗艦模型 Anthropic 在相同任務上的收費仍約為 Google 的 6 倍, 使 Gemini 3.8 Flash 仍站在成本效率前緣。
Google DeepMind 資深產品總監 Tulsee Doshi 與負責 Gemini 安全性的 Raluca Ada Popa 表示, 新模型「做得更多、想得更深」,會加入更多推理步驟、頻繁呼叫工具。 希望維持既有成本結構的使用者,仍可繼續使用 3.7 Flash; 至於 Pro 與 Ultra 訂閱用戶,則可在 Gemini App 的 AI 模式與 Google Sheets 中使用新版本。
Fairwind Program 限制網安模型開放對象
網路安全版本則置於全新的 Fairwind Program 門檻之後, 只對通過資格審查的政府機關、關鍵基礎設施營運者及開源/商業軟體維護者開放。
在涵蓋 20 種程式語言的內部測試中,該模型漏洞偵測成功率超過 70%。 Google 指出,其 Chrome 安全部門在該模型協助下,正確修補數量是多家規模更大的商業對手的 2.6 倍; 另有雲端研究團隊在不到兩小時內追蹤到一項關鍵弱點,而過去這類調查往往需耗時數月。
這波快速發版,發生在 Google AI 事業群經歷一段艱難期之後—— 先前鎖定 6 月推出的 Gemini 3.5 Pro 一度跳票,未能如期交付。
DeepMind 創辦人 Demis Hassabis 於 8 月初卸下執行長職務,轉任董事長, 由 Koray Kavukcuoglu 接手日常營運,但頭銜僅為資深副總裁,象徵權責架構調整。





