中国AI靠"蒸馏"追赶?业界质疑美方定性
nashnova research
"蒸馏"到底是什么?为什么突然成了焦点?
蒸馏(用一个更强的AI模型的输出,去训练一个更小或更新的模型——相当于"抄学霸的作业来提升自己")。
美国政府和Anthropic等实验室指控中国AI公司大规模蒸馏美国模型的能力,并将其定性为窃取行为。
这意味着→ 美方把"蒸馏"从一个常规技术手段重新定义成了知识产权问题,这是当前中美AI争端的一个关键叙事转向。
美方具体指控了什么?
Anthropic威胁情报负责人雅各布·克莱因称,存在一个完整的非法生态系统,试图获取Claude等模型的访问权限。
Anthropic本月发布报告,点名阿里巴巴、月之暗面和DeepSeek,称其试图通过"非法蒸馏"训练自身模型。
美国网络安全和基础设施安全局(CISA)更进一步,称中国公司正在对美国模型进行"系统性提取",并将这种工业规模的蒸馏定性为中国AI战略的"核心,而非补充"。
业界为什么不买账?
Cohere CEO艾丹·戈麦斯指出,中国AI模型已达"世界级"水平,美国领先优势"正在迅速消失"。他是2017年奠定现代AI基础的论文《Attention Is All You Need》共同作者之一。
戈麦斯的核心逻辑:"你无法靠复制或蒸馏来超越对手,只能缩小差距。" 中国模型已在部分基准测试上超过美国最好的模型,这意味着→ 蒸馏不足以解释中国的全部进步,背后必然有独立的创新能力。
前白宫AI政策高级顾问斯里拉姆·克里希南则从技术层面补充:ChatGPT和Claude本身也是在互联网信息上训练的,"蒸馏的概念一直是计算机科学运作方式的核心"。用大白话说= 所有大模型都在"蒸馏"人类已有知识,单独指控中国蒸馏,逻辑上站不稳。
这场争论真正的要害是什么?
争议的核心不是技术细节,而是政策叙事:"蒸馏是中国进步主因"这一判断,正是美国对华AI出口管制政策的重要支撑之一。
这意味着→ 如果业界越来越多人认定中国已具备独立创新能力,那么"限制出口就能遏制中国AI"的政策逻辑就会被动摇。
中国商务部已对"工业规模蒸馏"的指控予以反驳,但具体表态内容尚未完整披露。这反映出双方在事实认定层面仍存在大量信息差。
市场有风险,内容仅供研究参考,不构成投资建议。
