中国军方借美国AI模型训练国防系统

Taylor Wilson
Published todayAbout 3 min read

路透社审查逾80篇中国学术论文发现,解放军研究人员利用OpenAI和Anthropic模型的输出训练国内军用AI系统,暴露出美国出口管制在模型输出层面的实质性漏洞。

01

他们到底怎么用美国模型的?

核心手段是模型蒸馏(用大模型的输出去训练一个更小、更专用的模型)——不需要自己从头堆算力造大模型,只需要拿到大模型的"答案"就够了。
这意味着→ 出口管制卡住了芯片和算力,却没卡住模型的输出结果——而输出结果本身就能当"教材"用。
詹姆斯敦基金会研究员孙尼·张分析了其中逾60篇论文,指出中国军方科学家正在系统性提取西方模型的推理步骤,适配到监控、网络战和战术决策等场景。
02

具体用在了哪些军事场景?

解放军96941部队(驻北京的军事情报与网络战部队)用OpenAI的GPT-3.5处理敏感军事源代码,再用摘要训练一个完全运行在中国军事内网的国内模型。
中国北方工业大学(与中国武器工业关联密切)用Anthropic的Claude 3 Haiku生成合成数据,训练社交媒体监控和内容审核的文本分类模型。
解放军国防科技大学2024年一篇论文描述了用蒸馏技术压缩图像处理模型,部署在无人机上做实时视频分析和导航。
03

美国公司知道吗?能管住吗?

Anthropic表示不向中国或北京控制的企业提供Claude商业访问权限,并部署了监控系统检测违规行为。
但Anthropic同时承认:经蒸馏的模型可能丧失原始系统的安全护栏,敏感能力会被转移至其无法控制的模型中。
用大白话说= 公司能管住"谁能登录",但管不住"答案被拿走之后怎么用"——蒸馏发生在输出端,不在平台内部。
04

争的到底是什么?

争议核心不是蒸馏技术本身——蒸馏是业界广泛使用的常规做法——而是未经授权的提取行为
美国官员指控部分中国实体通过蒸馏提取美国AI模型能力,可能规避出口管制并侵犯知识产权;中国方面否认,称美国在推行AI"霸权主义"。
中国AI初创公司月之暗面上周否认其Kimi K3模型系通过蒸馏构建的指控,称该模型依托自主创新。
05

这件事说明了什么更大的问题?

蒸馏技术无法替代从头开发前沿AI所需的大规模算力,但这次披露说明:算力管制只是半道墙
这反映出美国出口管制体系存在一个结构性盲区——管住了造模型的"原料"(芯片、算力),却没有有效手段管住模型的"产出"(推理结果、训练数据)。
白宫、美国国防部、中国外交部、解放军及OpenAI均未回应路透社的置评请求。

Content is for reference only, not financial advice.

中国军方借美国AI模型训练国防系统 · nashnova