智谱发布新旗舰AI模型GLM-5.3 实测寻获逾千中高危漏洞 两周后公开模型权重
更新时间:17:47 2026-08-14 HKT
发布时间:17:47 2026-08-14 HKT
发布时间:17:47 2026-08-14 HKT
内地AI企业智谱(2513)发布最新旗舰模型GLM-5.3,主打程式开发及网络安全漏洞侦测。公司表示,新模型沿用GLM-5.2约7,000亿参数的基础模型,性能提升全部来自后训练阶段,模型权重将于两周后公开。
自家程式开发评测能力提升五成
据智谱公布的测试结果,GLM-5.3在自家程式开发评测中的整体能力,较GLM-5.2提升50%;在开源终端操作评测中,得分亦由4.6大幅增至28.3。
在自家程式开发评测的最高难度设定下,GLM-5.3使用约7.5万个输出词元,完成34.5%的任务;GLM-5.2即使使用约9.6万个词元,完成率亦只有23.4%。

智谱表示,GLM-5.3在网络安全漏洞侦测方面亦录得显著进步,不但能识别单一漏洞,亦可跨越多个漏洞利用阶段进行推理,规划完整的攻击链路。
漏洞发现测试微胜GPT-5.6
在CyberGym漏洞发现测试中,GLM-5.3取得84.5%,略高于Anthropic Mythos 5的83.8%及OpenAI GPT-5.6 Sol的83.6%。
不过,在要求更深入漏洞推理的ExploitBench测试中,GLM-5.3虽由上代的24.4%升至54.4%,仍低于Mythos 5的78%及GPT-5.6 Sol的76.5%。
在ExploitGym测试中,GLM-5.3于两小时及六小时内分别完成105项及130项漏洞利用任务,明显高于GLM-5.2的29项及39项,但仍落后于Mythos 5的181项及247项。
智谱表示,这些能力已延伸至真实世界的实际应用。公司自GLM-5.2推出以来,已联同内地多个安全团队测试真实程式库。经专家审核、筛选及去除重复结果后,模型在269个项目中识别出2,436个漏洞,当中1,097个属中度或高度风险,部分漏洞已存在数十年。
最Hit

















