中國軍方借美國AI模型訓練國防系統
Taylor Wilson
路透社審查逾80篇中國學術論文發現,解放軍研究人員利用OpenAI和Anthropic模型的輸出訓練國內軍用AI系統,暴露出美國出口管制在模型輸出層面的實質性漏洞。
他們到底怎樣用美國模型?
核心手段是模型蒸餾(用大模型的輸出去訓練一個更小、更專用的模型)——毋須自己從頭堆算力造大模型,只需拿到大模型的「答案」就夠。
這意味著→ 出口管制卡住了晶片和算力,卻沒卡住模型的輸出結果——而輸出結果本身就能當「教材」用。
詹姆斯敦基金會研究員孫尼·張分析了其中逾60篇論文,指出中國軍方科學家正系統性提取西方模型的推理步驟,適配到監控、網絡戰和戰術決策等場景。
具體用在了哪些軍事場景?
解放軍96941部隊(駐北京的軍事情報與網絡戰部隊)用OpenAI的GPT-3.5處理敏感軍事源代碼,再用摘要訓練一個完全運行於中國軍事內網的國內模型。
中國北方工業大學(與中國武器工業關係密切)用Anthropic的Claude 3 Haiku生成合成數據,訓練社交媒體監控和內容審核的文本分類模型。
解放軍國防科技大學2024年一篇論文描述了用蒸餾技術壓縮圖像處理模型,部署在無人機上做實時視頻分析和導航。
美國公司知道嗎?管得住嗎?
Anthropic表示不向中國或北京控制的企業提供Claude商業訪問權限,並部署了監控系統檢測違規行為。
但Anthropic同時承認:經蒸餾的模型可能喪失原始系統的安全護欄,敏感能力會被轉移至其無法控制的模型中。
簡單來說= 公司管得住「誰能登入」,卻管不住「答案被拿走之後怎麼用」——蒸餾發生在輸出端,不在平台內部。
爭的到底是甚麼?
爭議核心不是蒸餾技術本身——蒸餾是業界廣泛使用的常規做法——而是未經授權的提取行為。
美國官員指控部分中國實體通過蒸餾提取美國AI模型能力,可能規避出口管制並侵犯知識產權;中國方面否認,稱美國在推行AI「霸權主義」。
中國AI初創公司月之暗面上周否認其Kimi K3模型係通過蒸餾構建的指控,稱該模型依託自主創新。
這件事說明了甚麼更大的問題?
蒸餾技術無法替代從頭開發前沿AI所需的大規模算力,但這次披露說明:算力管制只是半道牆。
這反映出美國出口管制體系存在一個結構性盲區——管住了造模型的「原料」(晶片、算力),卻沒有效手段管住模型的「產出」(推理結果、訓練數據)。
白宮、美國國防部、中國外交部、解放軍及OpenAI均未回應路透社的置評請求。
Content is for reference only, not financial advice.