xAI 於2026年9月21日推出最新版人工智慧模型「Grok 4.7」。這款新模型強化了在程式撰寫、專業知識工作,以及需要數小時才能完成的複雜推理任務上的表現,同時代幣單價維持與前一版本相同的水準。新模型已迅速部署至開發工具與自家應用程式等多項服務,在與競爭模型的基準測試比較中也展現出穩定的進步。
基礎模型規模擴大,訓練資料更加豐富
Grok 4.7 的基礎模型參數量達到約2.1兆,較前一版本的1.5兆成長約四成。據悉,此次訓練採用了長時間的強化學習方式,運用需要數小時才能解決的高難度問題,重點提升了模型的自我驗證能力與長文本脈絡處理能力。此外,訓練資料中還納入了該公司太空業務累積的工程紀錄,據稱有助於提升模型在處理涉及實體系統的問題時的表現。
價格結構維持不變:每100萬輸入代幣2美元(約318日圓),每100萬輸出代幣6美元(約954日圓)。同時也提供回應速度更快的進階方案,輸出速度提升一倍,價格也相應提升一倍。
程式撰寫與專業領域基準測試穩步提升
在效能方面,Grok 4.7 在多項程式撰寫能力評測中取得明顯進步。某軟體開發任務評測指標從65.2%提升至71.0%,另一項指標也從40%出頭提升至46.3%,超越了部分GPT系列模型。終端機操作評測指標更是從20%左右大幅提升至38.0%。電機工程領域評測達到64.0%,法律類AI代理人評測也提升至19.6%,皆較前一版本有所進步。
在面向企業的智慧代理人評測中,Grok 4.7 同樣取得超過100分的顯著提升。不過,在部分評測面向上,該模型仍略遜於其他廠商的頂尖模型,顯示各前沿模型之間的競爭依然相當激烈。開發團隊表示,將在後續推出的新版本中持續提升效能。
安全機制全面翻新,拓展至開發工具與車用助理
此次更新也對安全機制進行了全面翻新。在生物安全相關評測中,該模型取得60%左右的分數;在網路安全相關的內部測試中,據稱在不影響正當安全研究用途的前提下,攔截了九成以上的危險用途提示詞。部分安全領域合作夥伴將獲邀取得用於防禦性研究的紅隊測試工具。
新模型的應用範圍也相當廣泛:使用者無需排隊即可透過開發工具與API使用該模型,同時該模型也已整合至專屬應用程式、社群平台整合,以及車用語音助理等現有服務中。
總結
xAI 推出的「Grok 4.7」透過擴大基礎模型規模、豐富訓練資料,提升了在程式撰寫與專業知識工作方面的表現。價格維持與前一版本相同的水準,同時多項基準測試成績均有提升,預計將在從開發工具到車用助理等廣泛場景中獲得應用。隨著後續新版本陸續推出,AI 開發領域的競爭走向值得持續關注。
※匯率換算參考:1美元=159日圓(截至2026年9月25日)
