中国AI企业Z.ai于2026年6月17日(日本时间)正式发布大语言模型「GLM-5.2」。其总参数量约为7530亿,在多项软件开发基准测试中超越GPT-5.5,并在编程性能排行榜上位列全球第二。更重要的是,模型本体以MIT许可证作为开源模型发布,任何人都可以下载使用。
作为免费开源模型登场
关于GLM-5.2的消息最早出现在2026年6月13日,正值Anthropic停止「Claude Fable 5」与「Claude Mythos 5」服务之时。当时仅披露了「强大的编程能力」「支持100万token输入」「可连续执行长时间任务」等方向,而此次正式发布则公开了具体性能。
最大的特点在于,模型权重本体以MIT许可证作为开源模型公开。用户可从Hugging Face上的「zai-org/GLM-5.2」免费获取,企业和个人能够自由下载验证,或针对自身用途进行微调。在众多最先进模型只能通过云端访问的当下,GLM-5.2保留了在本地环境中运行的选择。
7530亿参数也能轻量运行的MoE架构
GLM-5.2采用只激活所需专家的Mixture-of-Experts(MoE,混合专家)架构。总参数量约达7530亿,但单次推理实际运行的仅约400亿参数,兼顾了庞大规模与轻量处理。
在处理长上下文时的效率也经过优化。通过名为「IndexShare」的机制,在多个稀疏注意力层之间复用计算结果,据称即便处理多达100万token的庞大上下文,也能大幅降低每个token的计算量。其目的是通过架构本身,缓解上下文越长计算负担越急剧上升的传统弱点。
在编程与长时间任务中展现的实力
Z.ai最为强调的是编程与长时间任务的性能。在衡量实际缺陷修复能力的「SWE-bench Pro」中,它取得62.1分,超过GPT-5.5的58.6分。在难度更高的「FrontierSWE」中也达到74.4%,超越GPT-5.5的72.6%,逼近Claude Opus 4.8的75.1%。
在不告知模型名称、由人类评判质量的盲测中同样获得高度评价。在比较编程性能的「Code Arena」中,它压过Claude Opus 4.7与最新的Claude Opus 4.8,位列全球第二。在部分比较中,甚至获得超过刚刚停止服务的「Claude Fable 5」的评价。不过需要留意的是,这些数据大多由Z.ai或各排行榜公布。
使用方式、成本与需要注意的地方
GLM-5.2除了可通过Z.ai的聊天AI服务和API使用外,还支持「ZCode」「Claude Code」「OpenCode」等超过20种编程环境。能够直接融入日常使用的开发工具,是其实用之处。在成本方面,每个token的费用据称约为GPT-5.5的六分之一,对于需要长时间运行智能体处理的用途,更易于控制开销。
另一方面,也需要保持谨慎。作为开源模型在本地运行通常不成问题,但若在业务中使用Z.ai托管的API,已有观点指出在输入数据的处理上可能涉及中国的数据监管。处理高度机密信息的企业,需要在自建环境运行与使用外部API之间慎重权衡。
总结
GLM-5.2以MIT许可证将7530亿参数的大型模型作为开源模型公开,在编程与长时间任务中展现出超越GPT-5.5的实力。它在Code Arena上位列全球第二,部分场景下逼近最新的Claude Opus。作为可在自有硬件上运行的高性能模型,它对开发者而言是有力的选择;但在业务中使用托管API时,仍需关注数据的处理方式。
