Anthropic認證!中國最強模型智譜GLM-5.3:開源網安能力只差美國先進模型4個月

(圖:shutterstock)
(圖:shutterstock)

美國AI新創公司Anthropic前沿紅隊周二(9月29日)發布對智譜GLM-5.3的網路安全評估報告,稱這款開放權重模型已能自主構建端到端漏洞利用,綜合能力經NIST下屬CAISI獨立評估,落後美國先進模型約4個月,被視為中國開源大模型的「對手認證」。

報告以ExploitBench測試Chrome V8已知漏洞,GLM-5.3在410次嘗試中完成50次端對端利用,接近Anthropic自家Claude Mythos Preview的56次;內部二進制利用基準中,GLM-5.3約4%任務達成完整控制流劫持,而上代門檻模型接近0,而上代模型跨過門源模型。所有測試均在隔離沙箱、無外網環境下進行。

實戰驗證更具衝擊力。紅隊用GLM-5.3在某主流瀏覽器JavaScript引擎中發現多個未知漏洞,串聯成可讀取本地文件、SSH私鑰的攻擊鏈;用小號GLM-5.3-Flash組合公開缺陷,人工約20分鐘、模型自主運行約8小時、API要價0.4美元,即在ARM64環境產出可用。

報告中還警告護欄薄弱:直接惡意指令會拒絕,但偽裝紅隊演練可64%接單,修改開放權重去除拒絕機制可達100%。

智譜曾設API攔截等三層安全,延後兩週開放下載加固,強調開放權重下模型對齊最關鍵。

業界人士認為,開放權重降低攻防門檻,也利好防禦審計;GLM-5.3發布一月已有約100家安全企業接入,監管料將強化發布前紅隊測試、漏洞揭露與商用審查。


相關貼文

prev icon
next icon