Anthropic:智譜GLM-5.3網路攻擊能力接近Claude,但安全防護薄弱

nashnova research
今天发布阅读约 3 分钟

Anthropic報告顯示,智譜最新模型GLM-5.3在漏洞利用測試中的成功率已接近自家Claude,但安全機制極易被繞過——開放權重模型的攻擊能力正在逼近前沿,防護卻遠遠未跟上。

01

GLM-5.3的攻擊能力到底有多強?

GLM-5.3在410次嘗試中成功寫出端到端漏洞利用代碼50次,Claude Mythos Preview為56次——兩者差距已極小。
在更難的二進制漏洞利用(令程式偏離正常執行路徑、奪取控制權)測試中,GLM-5.3成功率4%,Claude為6%;Kimi K3與DeepSeek V4.1-Flash均為0%。
這意味著→ 在「能否寫出真正可用的攻擊代碼」這件事上,GLM-5.3已是中國開放權重模型中最強,而且正在逼近美國前沿模型。
02

安全防護為何形同虛設?

Anthropic測試發現,修改GLM-5.3的模型權重、移除安全防護後,模型拒絕惡意請求的比例從90%以上驟降至2%–12%。
簡單來說= 原本十個惡意請求模型會拒絕九個以上,拆掉防護後幾乎來者不拒。
這反映出開放權重模型(任何人都可以下載、修改的AI模型)的根本矛盾:能力開放的同時,安全機制也一併暴露給所有人,包括惡意使用者。
03

官方怎麼說?

美國商務部下屬CAISI(人工智能標準與創新中心)今年9月評估認為,GLM-5.3是目前已發佈的網絡攻擊能力最強的開放權重模型,落後美國前沿水平約四個月。
智譜全球事務負責人李子璇回應稱,該模型亦被用於網絡防禦——已協助保護389個開源項目,識別出4,249個潛在漏洞。
這意味著→ 同一套能力既可用來攻擊亦可用來防禦,爭論焦點不在技術本身,而在誰拿到了這個工具、能否被有效約束。
04

接下來看甚麼?

Anthropic這份報告首次以量化數據公開呈現中國開放權重模型的進攻性網絡能力,把一個此前停留在定性討論層面的問題擺到了枱面上。
後續的關鍵驗證節點:這份數據能否推動監管層對開源AI模型實施更嚴格的安全審查——尤其在模型權重可自由下載的前提下,現有安全框架是否仍能成立。
簡單來說= 以前說「開源模型可能被濫用」還只是擔憂,現在Anthropic給出了具體數字——問題不再是「會不會發生」,而是「多快會發生」。

市场有风险,内容仅供研究参考,不构成投资建议。

Anthropic:智譜GLM-5.3網路攻擊能力接近Claude,但安全防護薄弱 · nashnova