Google DeepMind 於 2026 年 9 月 2 日正式發表 Gemini 3.8 Flash,這是其 Flash 系列的第三次迭代,距離 3.7 Flash 發布僅三週。該模型同時推出兩個變體:標準版 Gemini 3.8 Flash 與針對網路安全強化的 Gemini 3.8 Flash Cyber。
Gemini 3.8 Flash:強化長時程推理與代理能力
效能突破
Gemini 3.8 Flash 在軟體工程與代理任務上有顯著提升:
- DeepSWE v1.1(長時程軟體工程基準):3.8 Flash 在自主解決複雜工程問題上超越多數較大的前緣模型,且成本顯著更低
- HLE-Verified:達到 54.9%,展現跨 STEM、人文與專業領域的多步驟推理能力
- Vals Finance Agent V2 與 Harvey’s Legal Agent Benchmark:在專業量化分析與法律任務中超越 3.7 Flash 及其他前緣模型
設計哲學:更努力的模型
Google DeepMind 指出,3.8 Flash 的效能提升源於一個核心設計選擇:「模型更努力地運算」。在複雜任務上,它會執行更多推理步驟、反覆呼叫工具,並在高努力模式下使用更多 Token 來最大化表現。對於運算效率優先的應用場景,開發者可選擇較低努力模式來減少 Token 開銷,或繼續使用仍受支援的 Gemini 3.7 Flash。
定價與可用性
| 指標 | 數值 |
|---|---|
| 輸入價格 | $0.75 / 百萬 Token |
| 輸出價格 | $3.75 / 百萬 Token |
| 可用平台 | Gemini API、Google AI Studio、Android Studio、Gemini Enterprise |
| 消費者端 | Google AI Pro/Ultra 訂戶、AI Mode、Google Sheets |
Gemini 3.8 Flash Cyber:前緣級網路安全能力
自主漏洞發現
3.8 Flash Cyber 在 CyberGym(業界標準漏洞發現基準)上達到前緣等級效能,超越 3.5 Flash Cyber 及更大的前緣模型。在 Google 內部涵蓋 20 種程式語言 的綜合漏洞發現基準測試中,成功率超過 70%。
自動修補能力
在 CWE-Bench(Collinear 營運的外部修補能力基準)上,3.8 Flash Cyber 達到 pass@1 47.2%,與領先前緣模型的 47.8% 僅差 0.6 個百分點,但成本大幅降低。
實際驗證
Google 已將 3.8 Flash Cyber 投入內部使用:
- Chrome 安全團隊:3.8 Flash Cyber 對 Chrome 漏洞產生的正確修補數量是其他商用模型的 2.6 倍
- Wiz:在其內部滲透測試基準上,3.8 Flash Cyber 的召回率高出 7.5-9.7%,成本降低 2.3-5.2 倍
- Google 雲端漏洞研究團隊:使用 3.8 Flash Cyber 在 不到 2 小時 內發現了一個通常需要數月研究的關鍵基礎漏洞
安全性與存取控制
3.8 Flash Cyber 配備了針對化學、生物、放射線、核子(CBRN)及網路攻擊領域的濫用防護措施。該模型僅透過 Fairwind 計畫 提供給經認證的政府機構、關鍵基礎設施營運商及軟體維護者。
產業意義
1. Flash 系列的快速迭代
從 3.6 Flash 到 3.7 Flash 再到 3.8 Flash,Google 在 六週內 完成了三次 Flash 模型迭代。這種發布節奏反映了 AI 模型訓練技術的持續加速,也顯示 Google 在高效能模型領域的野心已從「追趕」轉向「領先」。
2. 專用安全模型的戰略意義
3.8 Flash Cyber 的推出呼應了近期 AI 代理安全事件頻發的趨勢。將網路安全能力作為獨立模型變體提供,並透過 Fairwind 計畫嚴格控管存取,代表 Google 試圖在「安全能力擴散」與「防禦者賦能」之間找到平衡點。
3. 對開發者生態的衝擊
以 $0.75/百萬 Token 的價格提供接近前緣的程式碼生成能力,3.8 Flash 將進一步壓縮中小型模型提供商的利潤空間,並加速 AI 編程工具的價格下降趨勢。對於香港及亞洲的開發者而言,這意味著可以更低的成本獲得更高的 AI 編程輔助品質。
本文信息來源:Google Blog 官方公告「Introducing Gemini 3.8 Flash and 3.8 Flash Cyber」,2026 年 9 月 2 日。