中国军方和安全机构相关研究人员利用美国领先人工智能模型的输出,训练用于监控、无人机和战场行动的国产系统。对八十多篇学术论文和专利的审查发现,多家国防相关机构反复使用OpenAI和Anthropic工具。
核心方法是模型蒸馏,即把大型强模型的输出作为材料,训练更小、更专业的系统。由此获得的工具只需较少计算资源即可在本地运行,无需从头构建前沿模型也能转移有用能力。
与中国人民解放军有关的研究把蒸馏视为同时获取答案和推理过程的方式。詹姆斯敦基金会研究员桑尼·张分析了六十多篇论文,整个学术记录中还确认了另外二十多个军方相关案例。
北京的军事情报和网络战单位——解放军96941部队的一篇论文称,研究人员用GPT-3.5概括敏感军事软件代码,再利用摘要训练国产模型,使最终系统可完全在军网内运行,不把涉密材料交给外部系统。
中北大学研究人员使用Claude 3 Haiku,为社交媒体监测和内容审核系统生成合成数据。Anthropic表示不在中国或向受北京控制的企业提供Claude商业访问,并警告蒸馏模型可能失去原系统的安全保护。
军事部署研究不只涉及文本。国防科技大学通过蒸馏压缩图像处理模型,用于无人机实时视频分析、导航和目标支持,即使通信中断仍可工作。
军事科学院研究人员还在涉及无人机、舰艇和无人潜艇的模拟海上行动中,把蒸馏后的目标识别模型部署在战术硬件上。政府对模型轻量化和边缘计算的支持也推动相关系统进入卫星及算力有限的设备。
这种做法处于军事能力、出口管制和知识产权争议的交汇点,也给中国带来防御难题。陆军工程大学的一项研究分析了无数据蒸馏如何逆向提取模型能力,说明用于缩小技术差距的方法同样会让国产系统面临被复制的风险。



