真沒想到,Gemini 3.5 Pro 都還沒推出,Gemini 3.6 Flash 就來了。Google 稍早一口氣端出三款新模型,包括負責複雜工作的 Gemini 3.6 Flash、主打速度和大量部署的 Gemini 3.5 Flash-Lite,以及專門尋找與修補程式漏洞的 Gemini 3.5 Flash Cyber,目前在 Gemini 上已經能用到前面兩款新模型。
Google 推出 Gemini 3.6 Flash、3.5 Flash-Lite 與 Flash Cyber:輸出 Token 減少 17%,Flash-Lite 每秒可輸出 350 Token
Google 短時間就更新的 Gemini 3.6 Flash 新模型,這次最明顯的改進是 Token 效率。
根據 Google 公布的資料,Gemini 3.6 Flash 在 Artificial Analysis Index 中,完成相同工作時比 3.5 Flash 少 17%的 Token 輸出。在 Datacurve 的 DeepSWE 等特定測試裡,降幅最高更達 65%。Google 也表示,新模型處理多步驟工作時,需要的推理步驟與工具呼叫次數都比較少。這對一般聊天可能感覺不明顯,但如果企業同時運行數十或數百個代理,每次少繞幾個步驟,累積下來的等待時間與帳單差距就很可觀。
不僅如此,3.6 Flash 的價格也跟著降低。API 標準價格為每 100 萬輸入 Token 1.50 美元、輸出 Token 7.50 美元。對照 3.5 Flash 的輸入 1.50 美元、輸出 9 美元,輸入價格沒有變,但輸出便宜約 16.7%。再加上模型完成工作時使用的輸出 Token 也可能更少,這次的降價可說更有感。
程式寫作方面也有稍微提升,Gemini 3.6 Flash 在 DeepSWE 拿到 49%,3.5 Flash 為 37%。測試機器學習研究能力的 MLE Bench 則從 49.7%提升到 63.9%。Google 特別強調,新模型可以減少使用者沒要求的程式碼修改,也能縮短為了完成任務而反覆執行的循環。
另一項升級是 Computer Use,Gemini 3.6 Flash 在 OSWorld-Verified 的成績由 3.5 Flash 的 78.4%提高到 83.0%,Google 也把 Computer Use 整合成 Gemini API 與 Gemini Enterprise 裡的內建用戶端工具。開發者不必再另外串接一套獨立的電腦操作模型,就能讓代理點擊按鈕、填寫欄位,搭配其他工具完成多個步驟。
Gemini 3.6 Flash 在知識型工作也有進步,GDPval-AA v2 從 1,349 分提高到 1,421 分。Google 合作夥伴 Hebbia 與 Harvey 特別提到它處理多模態工作的能力,包括解析篇幅很長的文件、閱讀圖表與資料,以及根據分析結果撰寫報告。
安全部分,Gemini 3.6 Flash 也加入更完整的前沿安全防護,主要針對化學、生物、放射性、核能,以及網路攻擊等可能被濫用的領域。Google 表示,這些措施讓模型更能抵抗越獄提示詞,同時也有針對正常用途遭到誤拒的問題進行訓練。
Gemini 3.5 Flash-Lite 部分,適合代理搜尋、文件處理、資料萃取、翻譯與其他重視低延遲、高吞吐量的工作。根據 Artificial Analysis 測試,Gemini 3.5 Flash-Lite 每秒可輸出 350 Token,是 Gemini 3.5 系列速度最快的模型。
它的 API 價格也壓得很低,每 100 萬輸入 Token 只要 0.30 美元、輸出 Token 為 2.50 美元。Google 還提供更便宜的 Batch 與 Flex 選項,輸入和輸出價格分別降至 0.15 美元與 1.25 美元,適合不要求立即取得結果、但每天要處理大量資料的服務。
Gemini 3.5 Flash-Lite 也支援可調式思考層級。開發者處理簡單分類、內容擷取或格式轉換時,可以使用 Minimal、Low 等較低思考層級,以速度和成本為優先;碰到需要多個步驟的子代理工作,再提高思考層級,讓模型投入更多推理。
這種設計很適合多代理系統,如:Gemini 3.6 Flash 擔任主代理,負責拆解問題與分配任務,Flash-Lite 則同時執行大量較小的工作,不需要每件事情都動用價格較高的主力模型。
測試數據部分,Gemini 3.5 Flash-Lite 在 Terminal-Bench 2.1 拿到 54%,上一代 3.1 Flash-Lite 為 31%;長內容測試 GDM-MRCR v2 從 60.1%提高到 72.2%;GDPval-AA v2 更從 642 分增加到 1,140 分:
跟 Gemini 3 Flash 相比,3.5 Flash-Lite 在 SWE-Bench Pro 拿到 54.2%,高於前者的 49.6%;OSWorld-Verified 則是 74.0%對上 65.1%:
至於專為資安打造的 Gemini 3.5 Flash Cyber 新模型,以 3.5 Flash 為基礎,專門調校來尋找、驗證與修補程式中的安全漏洞。Google 會把多個 Flash Cyber 代理放進 CodeMender 協同工作,最後再產生一份整合報告。官方表示,這套組合在 CyberGym 測試中已達到前沿模型等級的競爭力:
由於資安模型同時具有防禦與攻擊的雙重用途,Gemini 3.5 Flash Cyber 不會像另外兩款模型一樣直接全面開放。Google 預計先透過 CodeMender,以限量試用方式提供給政府和受信任合作夥伴,讓防禦人員用來提早找出並修補漏洞,同時降低模型被拿去進行攻擊的風險。
除了新模型,Google 也更新 Gemini 3.5 Pro 的進度。目前模型正與合作夥伴進行封閉測試,等調校完成後才會擴大開放。Google 沒有給出確切日期,只表示會在模型準備好之後盡快推出。
Google DeepMind 也證實,團隊已經啟動 Gemini 4 的預訓練,而且形容這是目前「最具野心」的一次預訓練工作。只是官方目前沒有公布模型規模、功能、測試成績或預計推出時間,所以現階段只能確定 Gemini 4 已經開始訓練,還不能進一步推斷會在何時亮相。
Gemini 3.6 Flash 與 Gemini 3.5 Flash-Lite 已於 2026 年 7 月 21 日上線。開發者可透過 Gemini API、Google AI Studio 與 Android Studio 使用,3.6 Flash 也已加入 Google Antigravity。企業端可從 Gemini Enterprise Agent Platform 使用,3.6 Flash 同時進入 Gemini Enterprise App。
一般使用者可在 Gemini App 體驗這兩款模型,而 3.5 Flash-Lite 也會逐步導入 Google 搜尋。





