8 月 15 日消息,智谱昨日发布 GLM-5.3。新模型沿用 GLM-5.2 的基座,没有重新预训练,能力提升主要来自更长时间、更大规模和更多类型环境的后训练。官方称,GLM-5.3 已上线 ZCode、AutoClaw、GLM Coding Plan 与多家编码平台,API 将随后开放,模型权重计划在完成安全评估和加固后于两周内开源。

编程:Terminal-Bench 3.0 得分由 GLM-5.2 的 4.6 提升至 28.3,DeepSWE v1.1 由 46.2 提升至 66.9,Agents’ Last Exam 由 23.8 提升至 28.5。
代码执行效率:智谱自建 Z.ai Code Bench 显示,GLM-5.3 在 High 档位准确率为 31.4%,每项任务平均输出约 5 万 token;作为对照,Claude Opus 4.8 最高档位为 29.5%,平均输出约 12 万 token。
网络安全:GLM-5.3 在 CyberGym 得分 84.5%,略高于 Mythos 5 的 83.8% 和 GPT-5.6 Sol 的 83.6%;ExploitBench 得分 54.4%,仍低于两款闭源模型。
安全评估:智谱与高校及安全团队累计发现并去重 2436 个漏洞,其中 1097 个为中高危,涉及 269 个项目;已修复漏洞会进入公开披露账本,仍在协调披露的项目只展示哈希值。
智谱同时启动「开源的盾」计划,向开源项目提供持续安全审计、模型额度与 ZCode 代码审计入口。公司称,权重延后两周开放,是为了先限制潜在攻击能力并保留防御用途。