Googleは、手元のノートPCだけで動く新しいオープンモデル「Gemma 4 12B」を公開しました[1]。約120億パラメーターながら16GBのメモリがあればローカルで動作し、テキストに加えて画像・音声・映像もそのまま扱えるのが特徴です。モデルの重みはApache 2.0ライセンスで無償公開されており、クラウドに送らずに手元で完結するプライベートなAI活用の裾野を広げそうです。
16GBのノートPCで動く軽量オープンモデル
Gemma 4 12Bは、Googleが6月に打ち出したAI関連アップデートの1つとして登場しました[1]。Geminiがクラウド側の最上位モデルを担うのに対し、Gemmaはネットワークにつながなくても端末側で動かせる「オープンモデル」の系譜にあたります。
最大の売りは、特別なサーバーやGPUを用意しなくても、16GB程度のメモリを積んだ一般的なノートPCで動く点です[1]。モデルの規模は約120億パラメーター(12B)で、大規模なクラウド専用モデルと比べればコンパクトな部類に入ります[3]。それでいて高度な推論を手元でこなせるため、社外に出せないデータを扱う作業や、通信環境が不安定な現場でも使える点が実用的な強みになります[1]。
配布面もオープンです。重みはApache 2.0ライセンスで無償公開され、Hugging FaceやKaggleから入手できます[3]。動作環境もvLLMやllama.cppといった標準的な実行基盤に対応し、LM StudioやOllamaのような手軽なローカル実行ツールでもすでに扱えるため、開発者が自分の環境へ組み込みやすくなっています[3]。
エンコーダーを持たない統合アーキテクチャ
Gemma 4 12Bの技術的な目玉は、Googleが「統合(unified)」と呼ぶエンコーダーレスの設計です[2]。従来のマルチモーダルモデルは、画像や音声をいったん専用の変換モジュール(エンコーダー)で処理してから本体の言語モデルに渡す構成が一般的でした。エンコーダーはメモリと処理時間の負担になりやすく、動作を重くする要因でもあります。
Gemma 4 12Bはこの中間処理を省き、音声の波形や画像のデータを本体の言語モデルへ直接流し込みます[3]。これにより、テキスト・画像・音声・映像を1つの仕組みでそのまま扱えるようになりました。Googleはこれを、専用エンコーダーを介さずに音声と映像まで処理できる中規模オープンモデルとして位置づけています[2][3]。
一度に読み込める情報量も大きく、文脈window(コンテキストウィンドウ)は25万6千トークン(256K)に達します[3]。長い会議の文字起こしや大規模なソースコード、分量の多い資料をまとめて作業メモリに収められる計算で、ローカル動作のモデルとしては扱える素材の幅が広いといえます。
狙いは手元で動くAIエージェント
Googleは、Gemma 4 12Bを「ノートPC上で動くスマートなAIエージェント」を実現する土台と説明しています[1]。視覚とネイティブな音声処理を1つのまとまった仕組みに統合することで、日常的なハードウェア上でも速度を犠牲にせず、高度な推論とプライバシーを守った作業を両立できるとしています[1]。
背景には、AIを手元の端末で動かす「オンデバイスAI」への関心の高まりがあります。処理をクラウドに送らなければ、機密情報が外部に出るリスクを抑えられ、通信費や利用料の負担も軽くなります。オープンな重みを配布するモデルは、こうした用途で企業や開発者が自前の環境に組み込みやすく、Gemma 4 12Bもその流れに沿った一手といえます。
一方で、ここで挙げた性能や特徴は現時点ではGoogleの説明にもとづくものが中心です。実際の使い勝手や精度は、第三者による検証やベンチマークが出そろってから評価が固まっていくとみられます。オープンモデルは誰でも手元で試せる点が利点でもあるため、公開後の実測や比較が今後の焦点になりそうです。
まとめ
Gemma 4 12Bは、16GBのメモリを積んだノートPCでも動く約120億パラメーターのオープンモデルで、Apache 2.0ライセンスのもと無償で公開されました。エンコーダーを持たない統合アーキテクチャによって、テキストだけでなく画像・音声・映像までを1つの仕組みで扱え、25万6千トークンという広い文脈にも対応します。クラウドに頼らず手元で完結するAIエージェントの土台として、開発者やプライバシーを重視する現場での活用が広がるかが見どころです。
出典:https://blog.google/innovation-and-ai/technology/ai/google-ai-updates-june-2026/
出典:https://blog.google/innovation-and-ai/technology/developers-tools/introducing-gemma-4-12b/
