谷歌在 5 月的 Google I/O 上发布的顶级 AI 模型 Gemini 3.5 Pro,正进入面向 6 月内正式上线的最后阶段。它以高达 200 万 token 的上下文长度,以及一项更注重深度思考的新模式 Deep Think 为招牌,意在推理与多模态的前沿展开竞争。不过其正式发布尚未到来,目前仍处于有限预览阶段。

定位顶级的 Gemini 3.5 Pro

Gemini 3.5 Pro 是谷歌最新模型家族 Gemini 3.5 的顶级层级。此前由 "Ultra" 级别承担的用途——最困难的推理、高强度的多模态处理,以及超长上下文的读取——如今都由这款 Pro 接手。

最具代表性的规格是 200 万 token 的上下文窗口。上下文长度决定了模型一次能够处理的信息量,而这一数字是下位 Flash 所具备的 100 万 token 的 2 倍。如此之大的窗口,可让 Gemini 3.5 Pro 把长篇资料、大型源代码以及长时间的对话整体纳入工作记忆,大幅拓宽可处理素材的范围。

另一个亮点是名为 Deep Think 的推理模式。相比快速作答,它更着重花时间把复杂问题想透,并与跨图像和文本的多模态理解相结合,力求在高难度任务上展现实力。

Flash 与 Pro 的双层布局,以及备受关注的价格

谷歌已在春季较早时候推出了更快、更便宜的 Gemini 3.5 Flash。Flash 在编程和智能体性能上超越了上一代的 Pro,但在最困难的推理上略逊一筹——而这正是新款 Pro 要填补的空白。高频任务交给 Flash、繁重任务交给 Pro 的双层布局,是各家通用的设计。

在价格方面,该模型预计将首先通过面向个人的订阅提供。入口是每月 20 美元(约 3,200 日元)的 Pro 套餐,以及每月 250 美元(约 4 万日元)的 Ultra 套餐,Deep Think 作为 Ultra 套餐专属功能提供。通过 API 的按量计费,预计与以往各代一样约为 Flash 的 10 倍,即每百万输入 token 约 15 美元(约 2,400 日元),每百万输出 token 约 60 美元(约 9,700 日元)。这一水平足以与 Anthropic 和 OpenAI 的前沿模型正面竞争。

※1 美元 = 161 日元(截至 2026 年 6 月 24 日)。API 价格为预估值。

竞争加剧之际,仍停留在 "预告" 阶段

需要留意的是,即便到了 6 月下旬,Gemini 3.5 Pro 仍未广泛出货。在 I/O 上,谷歌首席执行官 Sundar Pichai 对观众表示,大致还需再等一个月——据称这句话让期待立即上手的现场观众发出了叹息。模型虽已在内部使用和面向企业的有限预览中运行,但正式上线仍在筹备之中。

在正式公开、第三方能够进行评测之前,这里列出的性能终究只是谷歌的说法。发布时间表也可能推迟,因此 "6 月" 应被理解为目标而非保证。前沿 AI 竞争正日趋激烈,各家对手接连推出高性能模型,打出低价的中国厂商也加入其中,价格下行压力不断加大。比起押注单一的最强模型,谷歌一直采取以广度和分发取胜的策略——按不同价位备齐模型,并融入自家产品与云服务。Gemini 3.5 Pro 正是这一布局中瞄准市场最顶端的一枚棋子。

总结

凭借 200 万 token 的上下文与 Deep Think 模式,Gemini 3.5 Pro 被定位为 Gemini 家族的旗舰,目标是在 6 月内正式上线。首先值得关注的,是它能否如期出货,以及在第三方评测之后实力将获得怎样的评价。若规格如约兑现,谷歌将获得一款足以对抗竞争对手顶级产品的旗舰,也有机会摆脱 "发布先于出货" 的印象。