中国人工智能实验室 Z.ai 在周四发布了 GLM-5.3,这是一个大型编码模型,它声称是市场上最强的开放权重编码器。该模型现在通过 GLM Coding Plan 订阅和 ZCode 上线,API 访问和可下载权重将在安全审核后推出。
“我们为 GLM-5.3 所做的就是扩展后训练,”公司在其 发布文章 中写道。“在 GLM-5.2 中,我们建立了基础……在过去的一个月里,我们继续在这基础上进行扩展:更多的环境,更多样化的任务,以及在这些任务上投入更多的计算资源。”
众多:开放人工智能何时发布 GPT-6? 点击进行预测。
团队更关注令牌效率,而不是原始的主导地位。GLM-5.3 拥有 7430 亿个参数,每个任务消耗的令牌数量比其前身少得多。参数是模型在处理信息时操作的拨号数量,而令牌是模型可以消费或生成的信息基本单位。
Z.ai 表示,GLM-5.3 在其内部的 Z.ai Code Bench 中以最大努力完成 34.5%,而每个任务大约消耗 75,000 个输出令牌,而 GLM-5.2 则为 23.4% 和 96,000 个。与封闭模型相比,博客中提到它在令牌经济上击败了 Claude Opus 4.8,但“仍落后于 Claude Fable 5,后者在最大努力下达到了 39.5%。”
在编码方面,GLM5.3 的表现非常好,在最相关的基准测试中超过了中国同行模型 Kimi K3。
在 Terminal Bench 3.0——一个在真实 Linux 环境中自主使用 shell/tool 的测试中——GLM-5.3 得分 28.3,稍微落后于封闭模型 Fable 5(33.7)和 GPT-5.6 Sol(34.6)。在 DeepSWE v1.1,一个针对端到端解决真实 GitHub 问题的基准测试中,开放竞争者 Kimi K3(67.5)和 Fable 5(69.7)都超过了 GLM-5.3 的 66.9。
这个模式可以简单总结如下:GLM-5.3 超过了自己的前身和一些开放同行,但封闭的美国模型仍然在头条编码榜上领先。
网络安全结果显示了另一个重要的飞跃。GLM-5.3 在 CyberGym 中以 84.5% 的成绩领先,并且在利用率基准测试中超过了 GLM-5.2 的两倍以上。Z.ai 表示该模型在 269 个开源项目中标记了 2,436 个漏洞,其中 1,097 个是中到高严重性。
“GLM-5.3 将代理编码提升到一个新的水平,相比 GLM-5.2 取得了显著改善,同时以更少的输出令牌实现了更好的结果,”Z.ai 在 X 上发布道。“GLM-5.3 现在可以通过 GLM Coding Plan 和 ZCode 获取。API 访问和开放权重将在经过严格的安全评估后逐步发布。”
在价格方面,与美国前沿模型的差距是开放权重的吸引力。Z.ai 的 GLM Coding Plan 采用积分配额(非高峰期调用费用减半),Zhipu 的 API 价格大约是美国前沿每令牌费的十分之一——GLM-5.2 的官方费率为每百万令牌 1.40 美元入 / 4.40 美元出。与此相比,GPT-5.3-Codex 的费用为 1.75 美元 / 14 美元,而 Claude Opus 4.8 接近 Anthropic 的定价顶端。
Z.ai 是一家北京实验室,列入了 美国实体名单,这意味着美国公司不能向其出口受控技术。尽管如此,GLM 是一个极受欢迎的模型,中国的开放权重模型在 OpenRouter 令牌使用上 已经超过了美国模型。
GLM-5.3 的权重预计将在大约两周内公开发布,发布文章中提到,开放权重标签适用于即将发布的内容,而不是今天可下载的内容。
免责声明:本文章仅代表作者个人观点,不代表本平台的立场和观点。本文章仅供信息分享,不构成对任何人的任何投资建议。用户与作者之间的任何争议,与本平台无关。如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到support@aicoin.com,本平台相关工作人员将会进行核查。