Google 在 5 月的 Google I/O 上發表的頂級 AI 模型 Gemini 3.5 Pro,正進入以 6 月內正式上線為目標的最後階段。它以高達 200 萬 token 的上下文長度,以及一項更著重深度思考的新模式 Deep Think 為招牌,意在推理與多模態的前沿一較高下。不過其正式發布尚未到來,目前仍處於有限預覽階段。

定位頂級的 Gemini 3.5 Pro

Gemini 3.5 Pro 是 Google 最新模型家族 Gemini 3.5 的頂級層級。先前由 "Ultra" 等級負責的用途——最困難的推理、高強度的多模態處理,以及超長上下文的讀取——如今都由這款 Pro 接手。

最具代表性的規格是 200 萬 token 的上下文視窗。上下文長度決定了模型一次能夠處理的資訊量,而這個數字是下位 Flash 所具備的 100 萬 token 的 2 倍。如此龐大的視窗,可讓 Gemini 3.5 Pro 把長篇資料、大型原始碼以及長時間的對話整體納入工作記憶,大幅拓寬可處理素材的範圍。

另一個亮點是名為 Deep Think 的推理模式。相較於快速作答,它更著重花時間把複雜問題想透,並與跨影像與文字的多模態理解相結合,力求在高難度任務上展現實力。

Flash 與 Pro 的雙層佈局,以及備受關注的價格

Google 已在春季稍早推出了更快、更便宜的 Gemini 3.5 Flash。Flash 在程式設計與代理任務的表現上超越了上一代的 Pro,但在最困難的推理上略遜一籌——而這正是新款 Pro 要填補的缺口。高頻任務交給 Flash、繁重任務交給 Pro 的雙層佈局,是各家通用的設計。

在價格方面,該模型預計將先透過個人訂閱提供。入口是每月 20 美元(約 3,200 日圓)的 Pro 方案,以及每月 250 美元(約 4 萬日圓)的 Ultra 方案,Deep Think 則作為 Ultra 方案專屬功能提供。透過 API 的用量計費,預計與以往各代一樣約為 Flash 的 10 倍,即每百萬輸入 token 約 15 美元(約 2,400 日圓),每百萬輸出 token 約 60 美元(約 9,700 日圓)。這樣的水準足以與 Anthropic 與 OpenAI 的前沿模型正面競爭。

※1 美元 = 161 日圓(截至 2026 年 6 月 24 日)。API 價格為預估值。

競爭加劇之際,仍停留在 "預告" 階段

值得留意的是,即便到了 6 月下旬,Gemini 3.5 Pro 仍未廣泛出貨。在 I/O 上,Google 執行長 Sundar Pichai 對觀眾表示,大致還需再等一個月——據說這句話讓期待立即上手的現場觀眾發出了嘆息。模型雖已在內部使用與面向企業的有限預覽中運行,但正式上線仍在籌備之中。

在正式公開、第三方能夠進行評測之前,這裡列出的效能終究只是 Google 的說法。發布時程也可能延後,因此 "6 月" 應理解為目標而非保證。前沿 AI 競爭正日趨激烈,各家對手接連推出高效能模型,打出低價的中國廠商也加入其中,使價格下行壓力不斷加大。比起押注單一的最強模型,Google 一直採取以廣度與通路取勝的策略——依不同價位備齊模型,並整合進自家產品與雲端服務。Gemini 3.5 Pro 正是這一佈局中瞄準市場最頂端的一枚棋子。

總結

憑藉 200 萬 token 的上下文與 Deep Think 模式,Gemini 3.5 Pro 被定位為 Gemini 家族的旗艦,目標是在 6 月內正式上線。首先值得關注的,是它能否如期出貨,以及在第三方評測之後實力將獲得怎樣的評價。若規格如約兌現,Google 將取得一款足以對抗競爭對手頂級產品的旗艦,也有機會擺脫 "發布先於出貨" 的印象。