Googleが、Geminiの主力モデル「3.6 Flash」と、軽量版の「3.5 Flash-Lite」を提供開始しました。3.6 Flashは前世代より出力トークンの消費を17パーセント減らしながら、価格も引き下げています[1]。あわせてセキュリティ特化の「3.5 Flash Cyber」も発表され、遅れているGemini 3.5 Proの状況と、次世代のGemini 4に着手したことも明かされました。

速さと安さの担当だったFlashが、質でも前に出る

Flashシリーズは、Geminiの中で効率と品質のちょうど良い落としどころを狙う位置づけのモデル群です。今回の3.6 Flashは、その延長線上にありながら、性能と単価の両方で前世代の3.5 Flashを上回ってきました。

数字がわかりやすいのはトークン効率です。Artificial Analysis Indexの計測で、3.6 Flashは3.5 Flashより出力トークンの消費が17パーセント少なく、Datacurveが提供するDeepSWEのようなベンチマークでは最大65パーセント減という結果も出ています[1]。同じ仕事をより短い出力で終わらせられる、ということです。

そのうえで価格は入力100万トークンあたり1.50ドル(約240円)、出力100万トークンあたり7.50ドル(約1,200円)に設定されました[1]。3.5 Flashの出力単価は100万トークンあたり9ドルでしたから、単価自体が下がっています[2]。消費するトークンが減り、そのトークンの単価も下がるわけで、エージェントを動かし続けたときのコストは二重に効いてきます。

ベンチマークで見る3.6 Flashの伸び

効率を上げると質が落ちる、という展開になっていないのが今回の要点です。Googleが挙げているのは次のような比較です[1]。

DeepSWEでは49パーセント対37パーセントとなり、余計なコード修正や実行ループが減ったとしています。機械学習の研究タスクを測るMLE Benchでは63.9パーセント対49.7パーセントと、伸び幅が大きく出ました。PC操作を伴うOSWorld-Verifiedでは83.0パーセント対78.4パーセント、実務寄りの評価であるGDPval-AA v2では1421対1349です。

なお、PC操作を行うコンピュータユースは、Gemini APIとGemini Enterpriseでクライアント側の組み込みツールとして使えるようになりました[1]。導入済みの顧客としてはHebbiaとHarveyの名前が挙がっており、文書の読み取りや図表・データの分析、レポートの下書きといったマルチモーダルな作業で手応えがあったとされています[1]。

安全性の面では、化学・生物・放射性物質・核(CBRN)とサイバー攻撃の領域でFrontier Safetyの対策を強化し、ジェイルブレイクへの耐性を高めたと説明しています。同時に、正当な用途での過剰な拒否を減らす方向でも学習させたとのことです[1]。

3.5 Flash-Liteは毎秒350トークン、量をさばく役へ

同時に出た3.5 Flash-Liteは、低遅延と高スループットが要る場面に振ったモデルです。エージェント的な検索や、大量の文書処理あたりが想定されています。

Artificial Analysisの計測で毎秒350トークンを出力し、3.5系では最速[1]。価格は入力100万トークンあたり0.3ドル(約50円)、出力100万トークンあたり2.5ドル(約400円)です[1]。

前世代の3.1 Flash-Liteとの比較では、Terminal-Bench 2.1が54パーセント対31パーセント、長文脈を測るGDM-MRCR v2が72.2パーセント対60.1パーセント、GDPval-AA v2が1140対642と、いずれも差が大きく開いています[1]。

興味深いのは、エージェント系やコーディング系の評価で、この軽量モデルが上位クラスの3 Flashを上回る場面があることです。SWE-Bench Proでは54.2パーセント対49.6パーセント、OSWorld-Verifiedでは74.0パーセント対65.1パーセントとなっています[1]。世代が1つ進むと、下位クラスが前世代の上位クラスを追い抜くという、この分野ではおなじみの構図です。

思考の深さは段階的に設定でき、大量処理では低遅延・低コスト側に、複数手順のサブエージェント処理では深い側に寄せる、といった使い分けができます[1]。

セキュリティ特化の3.5 Flash Cyberは政府と一部パートナー限定

3つ目の3.5 Flash Cyberは、3.5 Flashをベースに、脆弱性の発見と修正に絞って追加学習させたモデルです。Googleのコードセキュリティ用エージェントであるCodeMenderの中で複数体が協調して動き、1つの報告書にまとめる形で使われます。脆弱性ベンチマークのCyberGymで最前線に並ぶ水準に達したとしています[1]。

ただし、こちらは誰でも使えるわけではありません。攻撃にも防御にも転用できる技術であることを踏まえ、CodeMender経由で政府機関と信頼できるパートナーに限定した試験提供になると説明されています[1]。脆弱性を見つける速度が、直す速度をすでに追い越してしまっているという現状認識が背景にあり、配り方を絞るのは妥当な判断でしょう。

3.5 Proは遅れたまま、視線はGemini 4へ

今回の発表では、最上位のGemini 3.5 Proについても触れられています。現在はパートナー企業とテスト中で、準備が整い次第の広く提供するとされました[1]。当初の予定より投入がずれ込んでいる状態は続いていることになります。

その一方で、Googleは次世代のGemini 4に向けた事前学習をすでに開始しており、これまでで最も野心的な規模だと述べています[1]。最上位モデルの遅れを認めつつ、実際に数を出しているのは効率重視のFlash系という並びは、いま各社が置かれている状況をよく表しているように見えます。エージェントを本番で回し始めた開発者にとって、単純な賢さより1タスクあたりのコストのほうが切実になっている、ということです。

3.6 Flashと3.5 Flash-Liteは、Google AI StudioとAndroid Studio経由のGemini APIで本日から利用できます。3.6 FlashはGoogle Antigravityにも入り、企業向けにはGemini Enterprise Agent Platformで提供されます。一般利用者向けにはGeminiアプリから使え、3.5 Flash-LiteはGoogle検索にも順次展開されます[1]。

※1ドル162円換算(2026年7月21日終値ベース)

まとめ

Googleが公開した3.6 Flashは、出力トークンを17パーセント削りつつ単価も下げ、DeepSWEやMLE Benchなど主要な評価で3.5 Flashを上回りました。同時公開の3.5 Flash-Liteは毎秒350トークンの速さで量をさばく役割を担い、一部の評価では上位の3 Flashを追い越しています。セキュリティ特化の3.5 Flash Cyberは政府と信頼できるパートナー限定の試験提供です。最上位の3.5 Proは引き続きテスト中で、Googleの主戦場は当面、賢さよりも1タスクあたりのコストに移りつつあります。

出典:https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/

出典:https://9to5google.com/2026/07/21/gemini-3-6-flash-launch/