由 Elon Musk 領軍的 xAI 於 2026 年 6 月 28 日,將新一代大型語言模型 Grok 4.5 以僅限內部的私測形式,投入 SpaceX 與特斯拉。該模型以全新設計的基礎模型 V9 為底,規模擴大到 1.5 兆參數。xAI 表示,內部評測顯示其效能已逼近、甚至可能超越 Anthropic 的頂級模型 Opus。目前公司先在自家集團內部進行實地驗證,之後才會更大範圍釋出。

1.5 兆參數,採用全新基礎模型 V9

Grok 4.5 最受矚目的,就是 1.5 兆參數的規模。2026 年 5 月下旬登場的上一代 Grok 4.4 約為 1 兆參數,因此這次等於增加約 50%,而且只花了大約一個月就完成擴充。

模型的基礎採用 xAI 所稱的全新基礎模型 V9。它與目前在 X 上運作的小型模型採用不同設計,由此可看出 xAI 打算以這個基礎陸續推出衍生模型。在如此短的時間內不斷疊加世代的開發步調,對競爭對手而言也難以忽視。

強化程式能力的關鍵是「Cursor」資料

Grok 4.5 的另一項特色,是把程式編輯工具 Cursor 的使用資料納入輔助訓練。Cursor 是深受開發者歡迎的 AI 程式編輯器,其龐大的實際作業紀錄中,含有大量真實的程式撰寫流程、除錯步驟與設計判斷。以這類資料加以訓練,目的是提升模型在程式撰寫與技術推理上的準確度。

此外,xAI 也疊加了透過強化學習(藉由試誤來改進回答的方法)進行的持續調校,以及對其所稱 Grok Build 機制的更新。

為何先在 SpaceX 與特斯拉試用

在公開釋出之前,先將模型投入 SpaceX 與特斯拉兩家公司的第一線,背後自有考量。兩家公司都身處硬體設計、軟體與即時決策緊密交織的業務。火箭軌道計算、車輛軟體開發等遠比公開基準測試更困難的實務,每天都在發生。

這樣的第一線,為 xAI 提供了競爭對手難以複製的驗證環境。相較於許多 AI 公司以公開基準測試與模擬任務衡量效能,xAI 具備在自家集團真實營運資料上打磨模型的優勢。

「逼近 Opus」的說法仍待驗證

在效能方面,Musk 依內部評測表示,模型「逼近、甚至可能超越 Opus」。不過,這項說法完全建立在 SpaceX 與特斯拉內部的評測之上,截至 7 月上旬,尚未公布任何第三方獨立基準測試結果。部分提前試用早期版本的開發者稱其「使用感受與 Opus 相似」,但這同樣僅止於個人感想。要判斷其真正實力,仍須等待公開的評測指標或系統卡(system card)。

接下來:每月一款新模型與 Grok 5

xAI 為 2026 年下半年訂出相當積極的路線圖。據稱在年底之前,公司將以每月一款的步調,推出從零重新訓練的新基礎模型。再往後,據傳目標規模落在 6 兆到 10 兆參數之間的 Grok 5,已在名為 Colossus 2 的大型算力基礎上進行訓練。

每月一次的迭代能否直接轉化為效能的持續累積,目前仍是沒有答案的問題。即便如此,這樣的開發速度本身,幾乎必然會讓各家 AI 的競爭再往上加速。

總結

Grok 4.5 是 xAI 的最新模型,以全新基礎模型 V9 為底擴大到 1.5 兆參數,並藉由 Cursor 資料強化程式能力。它正在 SpaceX 與特斯拉內部進行實地驗證,而所謂「逼近 Opus」的效能仍待獨立評測檢驗。再加上每月釋出新模型以及雄心勃勃的 Grok 5 計畫,這都是在展望 2026 年下半年 AI 競爭走向時,不容錯過的動向。