Google 在今天凌晨(美國時間 9 月 2 日)正式發布 Gemini 3.8 Flash,距離上一代 3.7 Flash 僅隔三週,這也是 Google 在六週內推出的第三個 Flash 模型版本。此次發布包含兩個變體:一般用途的 Gemini 3.8 Flash,以及專為資安防禦設計的 Gemini 3.8 Flash Cyber。Google 表示,3.8 Flash 是目前最聰明的通用工作馬模型,在軟體工程、Agent 工作流和多步驟推理方面都有顯著提升,同時維持與 3.7 Flash 相同的速度和成本。
Gemini 3.8 Flash 效能表現:DeepSWE 73.7%,超越多數更大的前沿模型
Gemini 3.8 Flash 在多項基準測試中展現了接近高成本前沿模型的表現。在 DeepSWE v1.1(長週期軟體工程)測試中,3.8 Flash 拿下 73.7% 的成績,超越了多數體量更大的前沿模型,能以極低成本自主解決複雜的端到端工程問題。
在需要專業分析與報告的量化和專業領域,3.8 Flash 同樣表現亮眼。在 Vals Finance Agent V2 和 Harvey’s Legal Agent Benchmark 等測試中,3.8 Flash 均超越了 3.7 Flash 和其他前沿模型。 在 HLE-Verified 多步驟推理測試中,3.8 Flash 達到 54.9%,涵蓋 STEM、人文和專業領域。
這些效能提升來自一個核心設計選擇:3.8 Flash 在複雜任務上展現更高的勤勉度,會執行額外的推理步驟並迭代呼叫工具。Google 也坦承,模型在較高努力等級下可能會使用更多 Token 來最大化表現。 對於以運算效率為首要考量的應用,開發者可以使用較低的努力等級,或繼續使用 3.7 Flash。
Gemini 3.8 Flash Cyber:專為資安防禦者打造
此次發布的另一個亮點是 Gemini 3.8 Flash Cyber,這是 Google 目前最強的資安專用模型,專門針對漏洞偵測和自動修補設計。在漏洞發現的標準業界基準 CyberGym 上,3.8 Flash Cyber 達到 86.2%,展現了前沿水準的自主漏洞發現能力。在 Google 內部涵蓋 20 種程式語言的綜合測試中,成功率超過 70%。
在自動修補方面,CWE-Bench 測試中 3.8 Flash Cyber 達到 47.2% 的 pass@1 成績,與領先前沿模型的 47.8% 相當,但成本顯著更低。
Google 內部實測:Chrome 團隊修補效率提升 2.6 倍
Google 已在內部廣泛使用 3.8 Flash Cyber 來強化程式碼安全。根據官方公布的實測結果:
- Chrome 安全團隊發現 3.8 Flash Cyber 產生的正確漏洞修補數量,是其他體量更大的商業模型的 2.6 倍
- Google 雲端漏洞研究團隊利用 3.8 Flash Cyber 在不到 2 小時內發現了一個關鍵基礎漏洞,這類研究和發現通常需要數月時間
- Wiz(Google 收購的資安公司)在內部滲透測試基準上,3.8 Flash Cyber 的召回率比其他前沿模型高出 7.5% 至 9.7%,同時成本低 2.3 至 5.2 倍
Fairwind Program:資安專用模型的限縮存取機制
Gemini 3.8 Flash Cyber 並非對所有人開放,Google 同步推出了「Fairwind Program」,這是一個限縮存取計畫,僅提供給政府機構、關鍵基礎設施運營商和資安合作夥伴。目前全球已有超過 650 個合作夥伴參與此計畫,Google 將 3.8 Flash Cyber 與自家的 CodeMender 工具結合,讓防禦者能在安全的雲端環境中自主發現和修補漏洞,將過去需要數週的手動修補流程縮短到數分鐘。
Google 強調,3.8 Flash Cyber 的設計初衷是賦予防禦者優勢,而非強化攻擊能力。模型在化學、生物、放射性和核子(CBRN)以及網路攻擊等領域設有安全防護,Cyber 版本則針對資安場景提供更寬鬆的權限設定,因此僅限可信賴的防禦者使用。
定價與取得方式
Google 在定價策略上選擇了與 3.7 Flash 完全相同的價格帶,這意味著開發者在不增加成本的情況下就能獲得更好的模型表現。相較於其他前沿模型動輒數十美元的 Token 單價,3.8 Flash 的定價優勢相當明顯,這也是 Google 一直以來在 Flash 系列產品上堅持的「高效能、低成本」技術路線。
Gemini 3.8 Flash 維持與 3.7 Flash 相同的首發優惠價格:每百萬輸入 Token 0.75 美元,每百萬輸出 Token 3.75 美元(約新台幣 24 元與 122 元)。此優惠價格有效至 2026 年 12 月 31 日。
取得管道如下:
- 開發者:Google Antigravity、Google AI Studio、Android Studio[8]
- 企業用戶:Gemini Enterprise
- 消費者:Google AI Pro 和 Ultra 訂閱者可在 Gemini 應用、搜尋 AI Mode、Google Sheets 中使用
- 資安防禦者:透過 Fairwind Program 申請 3.8 Flash Cyber 存取權限[9]
技術核心:長週期 Agent 迴圈驅動的迭代推理
Google 在官方部落格中特別強調,3.8 Flash 的效能提升來自「長週期 Agent 迴圈」(long-running agentic loops)的技術路線。這是一種讓模型在處理複雜任務時,能自主執行多輪推理、評估和修正的機制。簡單來說,3.8 Flash 不只是「回答問題」,而是會像人類工程師一樣反覆檢查和改進自己的輸出。
這種設計也帶來了一個權衡:在高努力等級下,3.8 Flash 可能會消耗更多 Token 來換取更高的準確度。對於成本敏感的應用場景,Google 建議開發者使用較低的努力等級,或繼續採用 3.7 Flash 作為效率優先的選擇。
在安全性方面,Google 表示 3.8 模型在提示詞注入防護方面有顯著進步,在 Gray Swan 測試中展現了更強的防禦能力,能更有效地保護使用者免受惡意提示詞注入攻擊。
結語
Google 在六週內連續推出三個 Flash 版本的節奏,顯示了當前 AI 模型競爭的白熱化程度。3.8 Flash 在維持低成本的同時,將推理和編碼能力推向更接近前沿模型的水準,對需要大規模部署 AI Agent 的企業來說具有實際吸引力。而 3.8 Flash Cyber 則代表了 Google 在 AI 資安領域的策略佈局,透過 Fairwind Program 將最強的資安 AI 能力集中在可信賴的防禦者手中,而非毫無限制地對外開放。







