Google 週三推出最新模型 Gemini 3.8 Flash,在第三方智能評測中拿下 59 分,但代幣定價仍只及同級「前沿」系統的一小部分,並同步發布設有限制的網絡安全特別版本。
重點摘要:
- Gemini 3.8 Flash 在 Artificial Analysis Intelligence Index 拿到 59 分,比三星期前推出的前一版高出 3 分。
- 代幣價維持至今年 12 月 31 日:每百萬輸入代幣 0.75 美元、輸出代幣 3.75 美元,但每個任務實際成本較上代高約四成。
- 另有一個網絡安全特別版本,只透過全新的 Fairwind Program 向經審核的政府、基建營運商及軟件維護者開放。
Gemini 3.8 Flash 基準測試表現
Google 在 9 月 2 日公布兩個版本,這已是六星期內的第三次 Flash 系列更新。兩者同樣建基於一個核心系統,並在網絡安全相關數據上作重點訓練。
其中一個版本主攻編碼與智能代理(agent)應用,另一個則專責在大型代碼庫中尋找漏洞,訪問權限嚴格得多。
在高推理設定下,Gemini 3.8 Flash 在 Artificial Analysis Intelligence Index 的得分為 59 分,比 3.7 Flash 高 3 分,與 GPT-5.6 Sol 和 Grok 4.6 看齊。在多步推理評測 HLE-Verified 上,得分為 54.9%,涵蓋科學、人文及專業領域。Google 指出,在長周期軟件工程場景上,進步最為明顯。
收費方面,Google 將今年的試行價鎖定至 12 月 31 日:每百萬輸入代幣 0.75 美元、每百萬輸出代幣 3.75 美元。踏入元旦日,這兩個價格將會雙倍上調。
延伸閱讀:Claude Fable 5.1 登場:引入每次快取讀取 0.25 美元及反抄襲控制
為何 Gemini 每個任務成本反而更貴?
代幣更便宜,並不等於實際任務更省錢。按基準測試計算,新模型平均每個任務成本約 0.58 美元,比上一代貴約 40%。主因是平均輸出長度膨脹約三成至 48,000 個代幣,加上智能代理工作流程需要多輪互動。
同級對手 Anthropic 的旗艦模型,每個任務收費幾乎是 Google 的六倍,令 Gemini 仍然屬於成本前沿產品。
Google DeepMind 高級產品總監 Tulsee Doshi 與 Gemini 安全部門負責人 Raluca Ada Popa 表示,新模型「做得更多」,會主動增加推理步驟及更頻密地調用工具。希望維持舊有成本結構的團隊,可以繼續使用 3.7 Flash;而 Pro 和 Ultra 訂閱用戶可透過 Gemini App 的 AI Mode 及 Google Sheets 直接使用新版本。
Fairwind Program 嚴控網安版本開放對象
針對網絡安全的 Gemini 版本,被放在全新 Fairwind Program 之下,只向通過審核的政府部門、關鍵基礎設施營運商及軟件維護團隊開放。
在一項涵蓋 20 種編程語言的內部測試中,該模型在發現漏洞上的成功率超過 70%。Google 指出,其 Chrome 安全團隊在這套工具輔助下,產出的正確修補程式數量是多家規模更大的商業對手的 2.6 倍。另一個雲端研究團隊則在不足兩小時內追蹤到一項關鍵漏洞,而傳統流程往往需要數月時間。
Gemini 更新節奏加快,背後是該 AI 部門近月壓力漸增。原訂於 6 月推出的 Gemini 3.5 Pro 未有如期面世,市場一度質疑 Google 在競賽中的位置。
今年 8 月初,Demis Hassabis 宣布卸任 DeepMind 行政總裁,轉任主席一職,由 Koray Kavukcuoglu 接手領導,但職銜僅為高級副總裁,外界視之為權力「降級」重組。

