中國AI企業Z.ai於2026年6月17日(日本時間)正式發布大型語言模型「GLM-5.2」。其總參數量約為7530億,在多項軟體開發基準測試中超越GPT-5.5,並在程式設計效能排行榜上位居全球第二。更重要的是,模型本體以MIT授權條款作為開源模型發布,任何人都能下載使用。

以免費開源模型之姿登場

關於GLM-5.2的消息最早出現在2026年6月13日,正值Anthropic停止「Claude Fable 5」與「Claude Mythos 5」服務之際。當時僅透露了「強大的程式設計能力」「支援100萬token輸入」「可連續執行長時間任務」等方向,而此次正式發布則公開了具體效能。

最大的特點在於,模型權重本體以MIT授權條款作為開源模型公開。使用者可從Hugging Face上的「zai-org/GLM-5.2」免費取得,企業與個人能自由下載驗證,或針對自身用途進行微調。在眾多最先進模型只能透過雲端存取的當下,GLM-5.2保留了在自有環境中執行的選項。

7530億參數也能輕量執行的MoE架構

GLM-5.2採用只啟用所需專家的Mixture-of-Experts(MoE,混合專家)架構。總參數量約達7530億,但單次推論實際運作的僅約400億參數,兼顧了龐大規模與輕量處理。

在處理長脈絡時的效率也經過優化。透過名為「IndexShare」的機制,在多個稀疏注意力層之間重複利用運算結果,據稱即使處理多達100萬token的龐大脈絡,也能大幅降低每個token的運算量。其目的在於透過架構本身,緩解脈絡越長運算負擔越急遽上升的傳統弱點。

在程式設計與長時間任務中展現的實力

Z.ai最為強調的是程式設計與長時間任務的效能。在衡量實際除錯能力的「SWE-bench Pro」中,它取得62.1分,超越GPT-5.5的58.6分。在難度更高的「FrontierSWE」中也達到74.4%,超越GPT-5.5的72.6%,逼近Claude Opus 4.8的75.1%。

在不告知模型名稱、由人類評判品質的盲測中同樣獲得高度評價。在比較程式設計效能的「Code Arena」中,它壓過Claude Opus 4.7與最新的Claude Opus 4.8,位居全球第二。在部分比較中,甚至獲得超越剛停止服務的「Claude Fable 5」的評價。不過需要留意的是,這些數據大多由Z.ai或各排行榜所公布。

使用方式、成本與須注意之處

GLM-5.2除了可透過Z.ai的聊天AI服務與API使用外,還支援「ZCode」「Claude Code」「OpenCode」等超過20種程式設計環境。能直接整合進平常使用的開發工具,是其實用之處。在成本方面,每個token的費用據稱約為GPT-5.5的六分之一,對於需要長時間執行代理程式處理的用途,更易於壓低開銷。

另一方面,也須保持謹慎。作為開源模型在自有環境執行通常不成問題,但若在業務中使用Z.ai託管的API,已有意見指出在輸入資料的處理上可能涉及中國的資料法規。處理高度機密資訊的企業,需要在自建環境執行與使用外部API之間審慎衡量。

總結

GLM-5.2以MIT授權條款將7530億參數的大型模型作為開源模型公開,在程式設計與長時間任務中展現出超越GPT-5.5的實力。它在Code Arena上位居全球第二,部分情境下逼近最新的Claude Opus。作為可在自有硬體上執行的高效能模型,它對開發者而言是有力的選擇;但在業務中使用託管API時,仍須留意資料的處理方式。