Elon Musk氏が率いるxAIが、次世代の大規模言語モデル「Grok 4.5」を2026年6月28日、SpaceXとTeslaの社内向け限定ベータとして投入しました。新設計の基盤モデル「V9」をベースに規模を1.5兆パラメータへ広げ、社内評価ではAnthropicの最上位モデルOpusに迫る、場合によっては上回る可能性があるとしています。まずは自社グループの開発現場で実地検証を進める、慎重かつ攻めた立ち上げです。
規模は1.5兆パラメータ、基盤は新設計の「V9」
Grok 4.5で目を引くのは、やはり1.5兆パラメータという規模です。2026年5月下旬に登場した前世代のGrok 4.4は約1兆パラメータでしたので、そこから約50パーセントの上積みになります。しかも、その拡張をわずか1か月ほどで実現した計算です。
モデルの土台には、xAIが「V9」と呼ぶ新しい基盤モデルが使われています。現在Xで稼働している小型モデルとは設計を分けた作りで、ここから派生モデルを順次展開していく狙いがうかがえます。短い期間で世代を積み上げるこの開発ペースは、競合各社にとっても無視しにくい速さです。
コーディング強化のカギは「Cursor」データ
Grok 4.5のもう一つの特徴は、コード編集ツールCursorの利用データを補助的な学習に取り込んだ点です。Cursorは開発者に人気のAI搭載エディターで、その膨大な実作業の記録には、実際のコーディングの流れやデバッグの手順、設計上の判断が数多く含まれます。こうしたデータで鍛えることで、コーディングや技術的な推論の精度を底上げする狙いがあります。
加えて、強化学習(モデルの試行錯誤を通じて回答を改善する手法)による継続的な調整や、xAIが「Grok Build」と呼ぶ評価・改善の仕組みのアップデートも重ねられています。
なぜSpaceXとTeslaで先に試すのか
一般公開より先に、SpaceXとTeslaという2社の現場へ投入した点にも狙いがあります。両社はいずれも、ハードウェアの設計とソフトウェア、そしてリアルタイムの意思決定が密接に絡み合う事業です。ロケットの軌道計算や車両のソフトウェア開発といった、公開ベンチマークよりはるかに難しい実務が日々発生します。
こうした現場は、xAIにとって競合が簡単にはまねできない検証環境になります。多くのAI企業が公開ベンチマークや模擬的な課題で性能を測るのに対し、xAIは自社グループの実運用データで鍛えられる、という強みがあります。
「Opus級」の主張は、まだ検証の途上
性能について、Musk氏は社内評価をもとに「Opusに迫る、あるいは上回るかもしれない」と述べています。ただし、これはあくまでSpaceXとTesla社内での評価に基づく主張であり、7月上旬の時点で第三者による独立したベンチマーク結果は公開されていません。早期に試した一部の開発者からは「Opusに似た使い心地」との声も出ていますが、こちらも個人の感想の域を出ません。実力を見極めるには、公開された評価指標やシステムカードの登場を待つ必要があります。
今後は「毎月の新モデル」とGrok 5
xAIは2026年後半に向けて、かなり強気のロードマップを掲げています。年末までは、一から学習し直した新しい基盤モデルを毎月のペースで投入していく方針だとされます。さらにその先には、6兆から10兆パラメータ規模を狙うとされる「Grok 5」が控えており、大規模計算基盤「Colossus 2」で学習が進められていると伝えられています。
毎月の反復がそのまま性能の積み上げにつながるのかは、まだ答えの出ていない問いです。それでも、この開発速度そのものが、AI各社の競争を一段と加速させることは間違いなさそうです。
まとめ
Grok 4.5は、新基盤V9をベースに1.5兆パラメータへ拡張し、Cursorのデータでコーディング性能を磨いた、xAIの最新モデルです。SpaceXとTeslaの現場で先行検証を進めつつ、「Opus級」とされる性能の実力は独立した評価待ちという段階にあります。毎月の新モデル投入やGrok 5という野心的な計画も含め、2026年後半のAI競争を占ううえで見逃せない動きになりそうです。
