- 中国军事研究人员已通过一种名为模型蒸馏的技术,利用美国AI模型(如OpenAI的GPT-3.5和Anthropic的Claude)的输出结果来训练本国防务AI系统。
- 路透社对80多篇中国学术论文和专利的审查显示,解放军相关机构广泛使用蒸馏技术开发用于监控、网络战和战术决策的专业AI系统。
- 模型蒸馏利用强大AI系统的输出来训练更小、更专业的模型,相比从头构建前沿AI,可降低计算需求。
- 这种做法存在争议:美方指责中国实体未经授权提取数据,破坏了出口管制并侵犯知识产权;中方则否认依赖并指控美国搞“霸权主义”。
- 来自解放军联勤保障部队第96941部队的一篇论文描述了使用GPT-3.5对敏感军事源代码进行摘要,并基于这些摘要训练国内模型供军事网络内部使用。
- 其他案例包括:使用Claude 3 Haiku生成社交媒体监控的训练数据,蒸馏图像处理模型用于无人机部署,以及海上行动中的目标识别技术。
- 中国推动模型轻量化和边缘计算,使AI能在无人机和卫星上运行,但专家指出蒸馏模型存在局限性,无法完全复制前沿AI的广泛能力。
- 中国研究人员也正在研究蒸馏作为安全风险,并提出针对可能逆向破解模型的“无数据蒸馏”的防御方案。