美國當地時間9月29日,美國人工智慧企業Anthropic前沿紅隊發佈GLM-5.3網路安全能力研究報告。這份出自海外頂尖模型企業的報告,意外成為中國開源模型的一份“對手認證”。
據瞭解,Anthropic前沿紅隊是Anthropic內部一個專門研究前沿人工智慧模型能力與風險的技術研究團隊,其專門站在攻擊者視角,對Claude等前沿大模型開展高強度壓力測試,挖掘生物安全、網路安全、自主系統層面的災難性濫用風險。
該報告對中國人工智慧企業智譜GLM-5.3的網路能力進行了系統評測,並引用美國國家標準與技術研究院(NIST)下屬機構美國人工智慧標準與創新中心(CAISI)發佈的獨立評估結論稱,GLM-5.3是“迄今發佈的網路能力最強的開源權重模型”,綜合網路基準落後美國前沿水平約4個月。
在ExploitBench(漏洞利用基準測試)端到端漏洞利用測試中,智譜GLM-5.3在410次嘗試中成功了50次,Anthropic自家模型Claude Mythos Preview為56次,兩者表現接近。Anthropic報告還披露,研究人員借助GLM-5.3發現了瀏覽器中的未知漏洞,並在隔離環境中完成攻擊鏈驗證。
更具說服力的是漏洞實戰驗證。Anthropic紅隊研究員用GLM-5.3在某主流瀏覽器JS(JavaScript,一種網頁尾本語言)引擎中發現多個全新0-day(零日)漏洞並串聯為完整利用鏈,總成本僅20.40美元,人工介入約20分鐘、模型自主運行約8小時。 (長安街知事)
