Googleは9月2日、AIモデル「Gemini 3.8 Flash」の提供を開始しました。3週間前に出た3.7 Flashに続く、この6週間で3本目のFlash系リリースです。ソフトウェア開発、エージェント処理、専門分野の多段階推論を中心に性能を引き上げつつ、料金は3.7 Flashと同じ導入価格を維持しています。Googleが今回の特徴として挙げるのは、難しい課題ほど推論の手数を増やし、ツールを繰り返し呼び出して「より働く」という設計方針です。
3週間おきに世代が進むFlash
Flashシリーズは、Geminiの中でも速度と単価を優先した実務向けの系列です。今年の夏はその更新ペースが際立っていて、3.6 Flash、3.7 Flash、そして今回の3.8 Flashと、ほぼ3週間おきに新しい番号が付いています。第三者評価機関のArtificial Analysisは、4か月足らずで4本目のFlashモデルだと数えています。
Googleは3.8 Flashを「最も賢い働き手モデル」と位置づけ、同じ日に発表したサイバーセキュリティ特化版「Gemini 3.8 Flash Cyber」と基盤となる知能を共有していると説明しています。両モデルの土台を鍛えるにあたって、要求の厳しいサイバーセキュリティ分野での訓練がコーディングと推論全般の底上げに寄与したという言い方をしており、セキュリティ向けの研究開発が汎用モデルに還流している格好です。なおCyber版と、それを信頼できる防御側の組織へ提供する「Fairwind Program」については別の記事で取り上げているので、本稿では一般向けの3.8 Flashに絞ります。
ベンチマークで何が伸びたか
Googleが公表した結果では、伸びが目立つのは自律的に長時間動くタイプの課題です。
長期にわたるソフトウェア工学の課題を扱う「DeepSWE v1.1」では、複雑なエンジニアリング問題を最初から最後まで自律的に解く力で、より大型のフロンティアモデルの多くを上回ったとしています。しかもそれをはるかに低いコストで実現した、というのがGoogleの主張です。
専門分野向けでは、金融分析エージェントの評価「Vals Finance Agent V2」と、法務エージェントの評価「Harvey's Legal Agent Benchmark」で、3.7 Flashと他社のフロンティアモデルを上回りました。分野横断の難問集「HLE-Verified」では54.9パーセントを記録し、理工系から人文系、専門職領域まで多段階の推論をこなせるとしています。
数字はいずれもGoogle自身の公表値です。独立系のArtificial Analysisが同日に出した計測では、推論レベル「高」のときの総合指標「Intelligence Index」が59で、3.7 Flashの56から3ポイント上がりました。同機関によると、この伸びの主な要因はエージェント系の評価で、特に銀行業務を題材にしたツール利用の評価「τ³-Banking」が3.7 Flashから12ポイント上がって45パーセントになったとのことです。推論レベル「中」では57、「低」では52で、「低」の設定は3.6 Flashの「高」と同じスコアを、コストは3割低く、所要時間は約3分の1で出せるとしています。
「働く」ぶんトークンは増える
今回Googleが正面から説明しているのが、性能向上の出どころです。3.8 Flashは複雑な課題に対して、追加の推論ステップを踏み、ツールを反復して呼び出すという「勤勉さ」を見せるように作られています。その結果として、特に高い努力レベルでは性能を最大化するためにトークンをより多く使うことがある、とGoogle自身が明記しています。
この点は独立計測にも表れています。Artificial Analysisによると、トークン単価は3.7 Flashから変わっていないのに、1タスクあたりのコストは0.40ドル(約64円)から0.58ドル(約92円)へ約4割上がりました。理由は、1タスクあたりの平均出力トークンが3割増えて4万8,000トークンになったことと、エージェント系評価でやり取りの回数が増えたことです。処理時間も、推論レベル「高」では1タスク平均2.2分から2.5分へ伸びています。出力速度自体は毎秒約300トークンと速いままです。
それでも同機関は、3.8 Flashを「その知能水準では最も安いモデル」として、知能とコストのパレート最前線に位置づけています。推論レベルを「中」にすればタスクあたり0.41ドル(約65円)、「低」なら0.24ドル(約38円)まで下がるので、用途に応じて努力レベルを落とす選択肢が用意されています。Googleも、計算効率を最優先する用途では低い努力レベルを使うか、引き続きサポートされる3.7 Flashを使い続けてよいと案内しています。
価格は年内据え置き、2027年から倍額
料金は3.7 Flashと同じ導入価格で、入力が100万トークンあたり0.75ドル(約120円)、出力が3.75ドル(約600円)です。ただしこの単価は2026年12月31日までの期間限定で、2027年1月1日からは入力1.50ドル(約240円)、出力7.50ドル(約1,200円)に切り替わります。キャッシュ済み入力トークンの9割引きは引き続き適用されます。
※1ドル159円換算(2026年9月2日の終値ベース)
前述のとおり、3.8 Flashは同じ課題でも3.7 Flashより多くのトークンを使う傾向があります。単価が同じでも、エージェントを長時間回す用途では実際の請求額が3.7 Flash比で増える可能性があり、さらに年明けには単価そのものが倍になります。導入価格で試算して設計を固める前に、2027年以降の単価とトークン消費の増加分を合わせて見ておくのが無難です。
文脈長は100万トークンで3.7 Flashから変わっていません。入力はテキスト、画像、動画、音声に対応し、出力はテキストです。知識のカットオフは分野によって2026年3月、あるいは2025年1月にとどまる領域もあるとされています。
使える場所
3.8 Flashは発表と同時に各経路で利用できます。開発者はGoogle AI StudioとAndroid Studio経由のGemini API、エージェント開発環境の「Google Antigravity」、UI生成ツール「Stitch」から使えます。企業向けにはGemini Enterpriseで提供されます。個人ユーザーは、Google AI ProおよびUltraの契約者であれば、Geminiアプリ、Google検索のAIモード、Googleスプレッドシート内のGeminiで3.8 Flashを利用できます。
Googleは同時に、Antigravity上で簡単なプロンプトからパズル付きの3Dゲームを組み上げた例や、地図サービスをDOS風に再現した例、米国地質調査所の実データを使った地形図の可視化といったデモを公開しています。1回の指示で長く動き続けるエージェント用途を意識した見せ方です。
安全面では、化学・生物・放射性物質・核(CBRN)とサイバー攻撃への悪用に対する保護策を備えた状態で出荷されています。Gray Swanの評価では、Gemini 3.8世代はプロンプトインジェクションへの耐性も大きく改善したとされています。
まとめ
Gemini 3.8 Flashは、3週間前の3.7 Flashからさらに世代を進めた実務向けモデルで、長期のソフトウェア開発課題やエージェント処理、金融・法務のような専門分野で性能を伸ばしました。独立計測のIntelligence Indexは59と3ポイント上がっています。料金は入力0.75ドル、出力3.75ドルの導入価格を年内は据え置きますが、「より働く」設計のぶんトークン消費は増えており、タスクあたりのコストは約4割上がっています。2027年からは単価も倍になるため、導入時はその両方を織り込んで検討したいところです。
