智譜發布新旗艦AI模型GLM-5.3 實測尋獲逾千中高危漏洞 兩周後公開模型權重

更新時間:17:47 2026-08-14 HKT
發佈時間:17:47 2026-08-14 HKT

內地AI企業智譜(2513)發布最新旗艦模型GLM-5.3,主打程式開發及網絡安全漏洞偵測。公司表示,新模型沿用GLM-5.2約7,000億參數的基礎模型,性能提升全部來自後訓練階段,模型權重將於兩周後公開。

自家程式開發評測能力提升五成 

據智譜公布的測試結果,GLM-5.3在自家程式開發評測中的整體能力,較GLM-5.2提升50%;在開源終端操作評測中,得分亦由4.6大幅增至28.3。

在自家程式開發評測的最高難度設定下,GLM-5.3使用約7.5萬個輸出詞元,完成34.5%的任務;GLM-5.2即使使用約9.6萬個詞元,完成率亦只有23.4%。

智譜表示,GLM-5.3在網絡安全漏洞偵測方面亦錄得顯著進步,不但能識別單一漏洞,亦可跨越多個漏洞利用階段進行推理,規劃完整的攻擊鏈路。

漏洞發現測試微勝GPT-5.6 

在CyberGym漏洞發現測試中,GLM-5.3取得84.5%,略高於Anthropic Mythos 5的83.8%及OpenAI GPT-5.6 Sol的83.6%。

不過,在要求更深入漏洞推理的ExploitBench測試中,GLM-5.3雖由上代的24.4%升至54.4%,仍低於Mythos 5的78%及GPT-5.6 Sol的76.5%。

在ExploitGym測試中,GLM-5.3於兩小時及六小時內分別完成105項及130項漏洞利用任務,明顯高於GLM-5.2的29項及39項,但仍落後於Mythos 5的181項及247項。

智譜表示,這些能力已延伸至真實世界的實際應用。公司自GLM-5.2推出以來,已聯同內地多個安全團隊測試真實程式庫。經專家審核、篩選及去除重複結果後,模型在269個項目中識別出2,436個漏洞,當中1,097個屬中度或高度風險,部分漏洞已存在數十年。