Google 發表了 Gemini 系列的主力模型 3.6 Flash,以及輕量版的 3.5 Flash-Lite。3.6 Flash 的輸出 token 消耗較上一代減少 17%,價格也同時往下調整[1]。此外 Google 還公布了主打資安的 3.5 Flash Cyber,並說明了延後中的 Gemini 3.5 Pro 進度,以及已經啟動的下一代 Gemini 4。
主打效率的 Flash,如今在品質上也站得住腳
Flash 系列在 Gemini 家族中的定位,是在效率與品質之間取得平衡點。這次的 3.6 Flash 延續同一條路線,卻在效能與單價兩方面都勝過上一代的 3.5 Flash。
最好懂的數字是 token 效率。依據 Artificial Analysis Index 的量測,3.6 Flash 的輸出 token 消耗比 3.5 Flash 少 17%,在 Datacurve 提供的 DeepSWE 等基準測試中,降幅最高達到 65%[1]。換句話說,完成同樣的工作所需的輸出更短。
價格方面,輸入每 100 萬 token 為 1.50 美元(約 240 日圓),輸出每 100 萬 token 為 7.50 美元(約 1,200 日圓)[1]。3.5 Flash 的輸出單價為每 100 萬 token 9 美元,因此單價本身確實下降了[2]。消耗的 token 變少,單價也變低,對於需要長時間執行代理程式的情境來說,兩者會疊加起來。
從基準測試看 3.6 Flash 的成長
值得注意的是,效率提升並沒有犧牲品質。Google 提出的比較如下[1]。
DeepSWE 為 49% 對 37%,多餘的程式碼修改與執行迴圈都有所減少。衡量機器學習研究任務的 MLE Bench 為 63.9% 對 49.7%,差距更為明顯。牽涉電腦操作的 OSWorld-Verified 為 83.0% 對 78.4%,偏向實務評估的 GDPval-AA v2 則是 1421 對 1349。
電腦操作能力現已成為用戶端的內建工具,可透過 Gemini API 與 Gemini Enterprise 使用[1]。Hebbia 與 Harvey 等客戶表示,該模型在文件解析、圖表與資料分析、報告草擬等多模態任務上表現突出[1]。
在安全性方面,Google 表示該模型針對化學、生物、放射性與核子(CBRN)領域以及網路攻擊濫用強化了 Frontier Safety 防護,對越獄攻擊的抵抗力明顯提高。同時,模型也經過訓練以減少對正當用途的過度拒絕[1]。
3.5 Flash-Lite 每秒 350 token,負責消化大量任務
同步推出的 3.5 Flash-Lite 鎖定需要低延遲與高吞吐量的場景,例如代理式搜尋與大規模文件處理。
依 Artificial Analysis 量測,其輸出速度為每秒 350 token,是 3.5 系列中最快的[1]。價格為輸入每 100 萬 token 0.3 美元(約 50 日圓),輸出每 100 萬 token 2.5 美元(約 400 日圓)[1]。
與上一代 3.1 Flash-Lite 相比,差距相當可觀:Terminal-Bench 2.1 為 54% 對 31%,衡量長脈絡的 GDM-MRCR v2 為 72.2% 對 60.1%,GDPval-AA v2 則是 1140 對 642[1]。
更有意思的是,在多項代理式與程式設計評測中,這款輕量模型超越了更高一階的 3 Flash。SWE-Bench Pro 為 54.2% 對 49.6%,OSWorld-Verified 為 74.0% 對 65.1%[1]。新一代的低階型號反超上一代高階型號,在這個領域已是熟悉的格局。
思考深度可以分級設定,開發者既能在大量任務中偏向低延遲、低成本執行,也能在多步驟的子代理工作流程中啟用更深層的推論[1]。
主打資安的 3.5 Flash Cyber 僅限政府與可信賴夥伴
第三款 3.5 Flash Cyber 以 3.5 Flash 為基礎,針對漏洞的發現與修補進行微調。它會在 Google 的程式碼安全代理 CodeMender 中以多個實例協同運作,最後彙整成一份報告。Google 表示,它在漏洞基準測試 CyberGym 上達到了前沿水準[1]。
不過這款模型並非人人都能使用。考量到這項技術攻防兩用的性質,它將透過 CodeMender 以限量試行的形式,僅提供給政府機關與可信賴的合作夥伴[1]。背景在於目前發現漏洞的速度已經超過修補的速度,因此收窄發放範圍算是合理的判斷。
3.5 Pro 仍在延後,目光轉向 Gemini 4
這次發表也提到了頂規的 Gemini 3.5 Pro。目前正與合作夥伴進行測試,將在準備就緒後廣泛開放[1],也就是說延後的狀態仍在持續。
另一方面,Google 表示已經展開 Gemini 4 的預先訓練,並稱這是至今最具野心的一次[1]。一邊承認頂規型號延後,一邊實際出貨的卻是主打效率的 Flash 系列,這樣的組合恰好反映出當前各家所處的位置。對已經在正式環境中運行代理程式的開發者而言,單一任務的成本比單純的聰明程度更為迫切。
3.6 Flash 與 3.5 Flash-Lite 自即日起,可透過 Google AI Studio 與 Android Studio 的 Gemini API 使用。3.6 Flash 同時進駐 Google Antigravity,企業用戶則可透過 Gemini Enterprise Agent Platform 使用。一般使用者可在 Gemini 應用程式中使用,3.5 Flash-Lite 也將陸續導入 Google 搜尋[1]。
※1 美元 = 162 日圓(以 2026 年 7 月 21 日收盤價計)
總結
Google 公布的 3.6 Flash 在減少 17% 輸出 token 的同時調降單價,並在 DeepSWE、MLE Bench 等主要評測中勝過 3.5 Flash。同期推出的 3.5 Flash-Lite 以每秒 350 token 的速度承擔大量任務,在部分評測中甚至反超更高一階的 3 Flash。主打資安的 3.5 Flash Cyber 則是僅限政府與可信賴夥伴的限量試行。頂規的 3.5 Pro 仍在測試中,Google 近期的主戰場正從單純的效能轉向單一任務的成本。
來源:https://9to5google.com/2026/07/21/gemini-3-6-flash-launch/
