2026 年 8 月 14 日,智谱(Z.ai)发布最新旗舰模型 GLM-5.3,并重点强化编程和网络安全能力。 智谱公布的测试数据显示:GLM-5.3 在漏洞发现基准 CyberGym 中取得 84.5% 的成功率,高于 Anthropic Mythos 5 的 83.8% 和 OpenAI GPT-5.6 Sol 的 83.6%。
CyberGym 主要测试模型阅读源代码、识别软件安全漏洞并验证漏洞是否真实存在的能力。
在另一项 ExploitBench 测试中,GLM-5.3 得分为 54.4%,低于 Mythos 5 的 78.0% 和 GPT-5.6 Sol 的 76.5%。该测试主要考察模型将已发现漏洞进一步转化为可执行漏洞利用方式的能力。
智谱还进行了限时漏洞利用测试。GLM-5.3 在 2 小时内完成 105 项任务,6 小时内完成 130 项;Mythos 5 分别完成 181 项和 247 项。
除基准测试外,智谱还联合国内安全团队对真实代码库进行了测试。
经专家审核后,GLM-5.3 在 269 个项目中发现 2436 个漏洞,其中 1097 个被评为中高危漏洞。
智谱表示,GLM-5.3 并非专门为网络安全打造的模型,而是一款通用编程模型,其网络安全能力主要来自进一步的后训练和强化学习。
GLM-5.3 在复杂软件工程、终端操作和更广泛的真实世界 Agent 任务上均取得非常显著的进步。
GLM-5.3 与 GLM-5.2 使用相同的基础模型,但训练任务环境更长、类型更多。
智谱计划先完成安全评估和防护强化,并于约两周后开放 GLM-5.3 权重。
云头条声明:如以上内容有误或侵犯到你公司、机构、单位或个人权益,请联系我们说明理由,我们会配合,无条件删除处理。