中国AI实验室Z.ai于周四发布了GLM-5.3,这是一个大型编程模型,该公司称之为当前市场上最强的开放权重代码模型。该模型目前已通过GLM Coding Plan订阅和ZCode上线,API访问与可下载权重将在安全审查后陆续推出。
“对于GLM-5.3,我们所做的只是扩展后训练,”该公司在发布帖中写道。“我们在GLM-5.2上构建了技术栈……过去一个月我们持续在该技术栈上扩展:更多环境、更多样化任务,以及更多用于训练的计算。”
Myriad:OpenAI何时发布GPT-6?点击预测。
团队更关注token效率而非原始优势。GLM-5.3参数为7430亿,每项任务消耗的token远少于前代。参数指模型处理信息时调节的量,token是模型消耗或生成信息的基本单位。
Z.ai表示,GLM-5.3在自建Z.ai Code Bench最大努力下达到34.5%,每项任务约输出75000 token,而GLM-5.2为23.4%与96000。与闭源模型相比,其在token经济性上击败Claude Opus 4.8,但“仍落后于Claude Fable 5,后者最大努力达39.5%”。
在编程方面,GLM-5.3表现良好,在相关基准上超越同为中国模型的Kimi K3。在Terminal Bench 3.0(真实Linux环境自主shell/工具使用测试)中,GLM-5.3得分28.3,略落后于闭源模型Fable 5(33.7)与GPT-5.6 Sol(34.6)。在DeepSWE v1.1(端到端修复真实GitHub问题基准)中,开放对手Kimi K3(67.5)与Fable 5(69.7)均高于GLM-5.3的66.9。
总体来看:GLM-5.3超越前代与部分开放同行,但美国闭源模型仍领跑核心编程榜。网络安全结果展现另一跃升:GLM-5.3以84.5%领先CyberGym,利用基准上超GLM-5.2两倍。Z.ai称模型在269个开源项目发现2436个漏洞,其中1097个为中高危。
“GLM-5.3将智能体编程提升至新高度,较GLM-5.2大幅改进且以更少输出token获更好结果,”Z.ai在X上发文称,“现可通过GLM Coding Plan与ZCode使用,API与开放权重将在严格安全评估后分阶段发布。”
价格上,与美国前沿模型的差距正是开放权重吸引力。GLM Coding Plan按点数配额(非高峰半价),智谱API每token价约为美国前沿十分之一——GLM-5.2官方价为每百万token输入1.40美元/输出4.40美元,对比GPT-5.3-Codex的1.75/14美元与Claude Opus 4.8高位档。
Z.ai是列入美实体清单的北京实验室,美企不得向其出口受控技术。尽管如此,GLM极受欢迎,中国开放权重模型在OpenRouter使用量已超美国。据发布帖,GLM-5.3权重约两周后公开,开放权重标签指未来而非当前可下载内容。
