多项最新研究和专利显示,中国军方科研人员正利用 OpenAI 与 Anthropic 大模型的输出,训练本土防务人工智能系统。一项梳理逾80篇中文学术论文和专利的评估认为,这已在解放军相关科研体系中形成体系化做法。
核心要点:
- 评估超过80篇中国论文和专利,发现多家与军方有关机构正将美国前沿大模型“蒸馏”为本地小型系统。
- 某解放军网络战部队曾向 GPT-3.5 输入敏感军事源代码,再利用其摘要训练国产模型。
- Anthropic 表示其未在中国开展商业销售,并警告蒸馏复制会削弱原始模型的安全护栏。
逾80篇论文揭示“蒸馏式”军用 AI 路线
这项评估部分由华盛顿智库 Jamestown Foundation 参与完成,并通过多家机构发布的公开文献予以披露。研究人员发现,涉及单位包括多所与中国人民解放军直接或间接关联的实验室,并额外锁定了约两打军方背景的应用案例。
文献普遍描述了一类称为“模型蒸馏”的技术路径:由算力和能力更强的大模型生成大量输出,再将这些输出转化为训练数据,灌入体量更小、可在受限硬件上运行的本地模型之中。
其中,一篇来自设在北京的解放军96941部队——被外界视作集情报与网络战职能于一体的单位——的论文披露,研究团队向 OpenAI 的 GPT-3.5 输入包含敏感军事源代码的内容,保留模型生成的技术摘要与分析,再以此为语料训练国产模型。最终系统完全部署在军网环境内运行,无需访问境外服务器。
白宫、五角大楼、中国外交部、解放军及 OpenAI 均未就此回应置评请求。
延伸阅读:AI 基础设施:发薪日贷款商的百亿美元“豪赌”转身冲刺数据中心
张舜溢:中方在“偷走推理过程”
Jamestown 研究员 Sunny Cheung(张舜溢) 参与分析了其中逾60篇论文。他指出,中国军工科研团队并非仅关心“正确答案”,而是在系统性捕获西方前沿系统的“推理步骤”。
他在接受采访时表示,这些成果被导向监控系统、网络作战平台和战术决策辅助工具。“教会一个模型给出正确答案是一回事,把背后的推理路径压缩进一个更小的模型则难得多。”他说。
与中国军工体系关系密切的中北大学研究团队,则被发现利用 Anthropic 的 Claude 3 Haiku 生成合成训练数据,用于一套社交媒体舆情监测工具。Anthropic 表示,公司未在中国出售任何商业版 Claude 访问权限,并通过监测系统标记违规用途,同时警告,经蒸馏复制后形成的模型往往会丧失原始系统内置的安全保护机制。
蒸馏瓶颈与出口管制“灰区”
AI 数据公司 Sapien 联合创始人 Trevor Koverko 指出,被蒸馏出的模型在能力上仍难以完全比肩原始系统。他在接受采访时称,这更像是一种“选择性能力移植”——把部分关键功能转移到更便宜、受本地控制的系统中,而非真正实现对前沿 AI 的技术独立。
与此同时,中国中央及地方政府正加大对模型轻量化与边缘计算的扶持力度,补贴资金更多流向可部署在无人机、卫星以及其他受限终端上的软件方案。
围绕“蒸馏”技术的争议已酝酿数月。美国财政部长 Scott Bessent 今年7月发出制裁威胁,表示将锁定被认定大规模从事蒸馏复制行为的中国企业。初创公司 Moonshot 上周则否认其 Kimi K3 模型依赖类似路径;北京方面则反指华盛顿搞“人工智能霸权主义”,并点名称美国科技公司同样在内部广泛运用蒸馏技术。






