Anthropic:智谱GLM-5.3网络攻击能力接近Claude,但安全防护薄弱

nashnova research
今天发布阅读约 3 分钟

Anthropic报告显示,智谱最新模型GLM-5.3在漏洞利用测试中的成功率已接近自家Claude,但安全机制极易被绕过——开放权重模型的攻击能力正在逼近前沿,防护却远远没跟上。

01

GLM-5.3的攻击能力到底有多强?

GLM-5.3在410次尝试中成功写出端到端漏洞利用代码50次,Claude Mythos Preview为56次——两者差距已极小。
在更难的二进制漏洞利用(让程序偏离正常执行路径、夺取控制权)测试中,GLM-5.3成功率4%,Claude为6%;Kimi K3和DeepSeek V4.1-Flash均为0%。
这意味着→ 在"能不能写出真正可用的攻击代码"这件事上,GLM-5.3已经是中国开放权重模型里最强的,而且正在逼近美国前沿模型。
02

安全防护为什么形同虚设?

Anthropic测试发现,修改GLM-5.3的模型权重、移除安全防护后,模型拒绝恶意请求的比例从90%以上骤降至2%–12%。
用大白话说= 原本十个恶意请求模型会拒绝九个以上,拆掉防护后几乎来者不拒。
这反映出开放权重模型(任何人都可以下载、修改的AI模型)的根本矛盾:能力开放的同时,安全机制也一并暴露给了所有人,包括恶意使用者。
03

官方怎么说?

美国商务部下属CAISI(人工智能标准与创新中心)今年9月评估认为,GLM-5.3是目前已发布的网络攻击能力最强的开放权重模型,落后美国前沿水平约四个月。
智谱全球事务负责人李子璇回应称,该模型也被用于网络防御——已协助保护389个开源项目,识别出4,249个潜在漏洞。
这意味着→ 同一套能力既能用来攻击也能用来防御,争论的焦点不在技术本身,而在谁拿到了这个工具、能不能被有效约束。
04

接下来看什么?

Anthropic这份报告首次以量化数据公开呈现中国开放权重模型的进攻性网络能力,把一个此前停留在定性讨论层面的问题摆到了台面上。
后续的关键验证节点:这份数据能否推动监管层对开源AI模型实施更严格的安全审查——尤其是在模型权重可自由下载的前提下,现有安全框架是否还能成立。
用大白话说= 以前说"开源模型可能被滥用"还只是担忧,现在Anthropic给出了具体数字——问题不再是"会不会发生",而是"多快会发生"。

市场有风险,内容仅供研究参考,不构成投资建议。

Anthropic:智谱GLM-5.3网络攻击能力接近Claude,但安全防护薄弱 · nashnova