Kimi K3网络安全测试逼近GPT-5.6,引发美国AI管制争议
0xBroomberg
月之暗面开源模型Kimi K3在26个漏洞测试中命中23个,追平OpenAI中端产品GPT-5.6 Terra,成本仅为旗舰版四分之一——这正迫使华盛顿重新审视:对本国AI设限是否反而让中国对手更具竞争力。
这个测试到底测了什么?
瑞士网络安全公司Aikido Security用26个近期发现的已知漏洞,逐一测试主流AI模型的检测能力。
关键设计:漏洞都是近期才披露的,这意味着→ 模型不可能从训练数据里"背答案",测的是真实推理能力。
Kimi K3(月之暗面旗下,2.8万亿参数开源模型)找到了23个,与OpenAI中端产品GPT-5.6 Terra持平。
便宜多少?便宜意味着什么?
Kimi K3运行成本仅为OpenAI旗舰版GPT-5.6 Sol的四分之一。
用大白话说= 同样的安全检测任务,用Kimi K3跑一遍的钱,只够用GPT-5.6 Sol跑四分之一。
Aikido报告称Kimi K3是当前网络安全领域最强的开放权重模型,"远超"智谱AI上月发布的GLM-5.2。
Vercel CEO劳奇的评价给出了一个坐标:GPT-5.6 Sol仍"领先一个量级",但Kimi K3已是"顶级"网络安全模型,且价格显著更低。
开源追平闭源,为什么这件事重要?
Aikido研究员杜拉索夫明确判断:测试结果反映了Kimi系列模型能力的"大幅跃升","开源模型已不再落后于闭源模型"。
这反映出一个更深的趋势——在网络安全这个对推理能力要求极高的领域,开源模型的天花板正在被快速抬高。
这意味着→ 过去"闭源=更强"的默认假设,至少在网络安全赛道已经不再成立。
华盛顿为什么紧张?
争议的核心:美国以安全为由对本国顶尖AI模型设置护栏(使用限制),但中国开源模型在关键能力上持续追近。
用大白话说= 如果美国自己绑住手脚,而对手不受同样限制还在变强,美国企业就可能在竞争中落后。
自Anthropic今年4月推出Claude Mythos以来,能自主识别和利用网络漏洞的AI系统能力已快速提升——这反映出这一赛道的竞争格局正在加速演变,政策窗口在收窄。
Content is for reference only, not financial advice.