智譜發布新旗艦AI模型GLM-5.3 實測尋獲逾千中高危漏洞 兩周後公開模型權重
內地AI企業智譜(2513)發布最新旗艦模型GLM-5.3,主打程式開發及網絡安全漏洞偵測。公司表示,新模型沿用GLM-5.2約7,000億參數的基礎模型,性能提升全部來自後訓練階段,模型權重將於兩周後公開。
自家程式開發評測能力提升五成
據智譜公布的測試結果,GLM-5.3在自家程式開發評測中的整體能力,較GLM-5.2提升50%;在開源終端操作評測中,得分亦由4.6大幅增至28.3。
在自家程式開發評測的最高難度設定下,GLM-5.3使用約7.5萬個輸出詞元,完成34.5%的任務;GLM-5.2即使使用約9.6萬個詞元,完成率亦只有23.4%。

智譜表示,GLM-5.3在網絡安全漏洞偵測方面亦錄得顯著進步,不但能識別單一漏洞,亦可跨越多個漏洞利用階段進行推理,規劃完整的攻擊鏈路。
漏洞發現測試微勝GPT-5.6
在CyberGym漏洞發現測試中,GLM-5.3取得84.5%,略高於Anthropic Mythos 5的83.8%及OpenAI GPT-5.6 Sol的83.6%。
不過,在要求更深入漏洞推理的ExploitBench測試中,GLM-5.3雖由上代的24.4%升至54.4%,仍低於Mythos 5的78%及GPT-5.6 Sol的76.5%。
在ExploitGym測試中,GLM-5.3於兩小時及六小時內分別完成105項及130項漏洞利用任務,明顯高於GLM-5.2的29項及39項,但仍落後於Mythos 5的181項及247項。
智譜表示,這些能力已延伸至真實世界的實際應用。公司自GLM-5.2推出以來,已聯同內地多個安全團隊測試真實程式庫。經專家審核、篩選及去除重複結果後,模型在269個項目中識別出2,436個漏洞,當中1,097個屬中度或高度風險,部分漏洞已存在數十年。
---------------------------------------------
>>>星島網WhatsApp爆料熱線(416)6775679,爆料一經錄用,薄酬致意。
>>>立即瀏覽【生活百答】欄目:新移民抵埗攻略,老華僑也未必知道的事,移民、工作、居住、食玩買、交通、報稅、銀行、福利、生育、教育。
>>>星島網WhatsApp爆料熱線(416)6775679,爆料一經錄用,薄酬致意。
>>>立即瀏覽【生活百答】欄目:新移民抵埗攻略,老華僑也未必知道的事,移民、工作、居住、食玩買、交通、報稅、銀行、福利、生育、教育。
