一項涵蓋逾 80 篇學術論文與專利的最新審閱顯示,中國軍方研究人員正在利用 OpenAI 和 Anthropic 等美國前沿大模型的輸出,訓練國內軍事及國防 AI 系統。
重點摘要:
- 審閱逾 80 份中國論文與專利,發現多家與解放軍相關機構,正把美國前沿模型輸出「蒸餾」成較小型本土系統。
- 一支解放軍網絡戰部隊向 GPT-3.5 提交敏感軍事源碼,取得摘要後再用作訓練國產模型。
- Anthropic 指其未在中國提供商業存取,並警告經「蒸餾」複製的模型或會失去原有安全防護。
逾 80 篇論文揭 AI 模型「蒸餾」實況
這批中方論文與專利,由部分與華盛頓智庫 Jamestown Foundation 合作的研究者整理,並在美國防務媒體的報道中浮面,指涉多間與中國人民解放軍有聯繫的科研機構。審閱者並額外鎖定約兩打軍方相關個案研究。
文件詳述所謂「模型蒸餾」(model distillation)技術,即把大型、算力要求高的強勢模型輸出,轉化為新一輪訓練數據,餵給體量較小、可在有限硬件上運行的本土系統。
當中一篇由駐北京的解放軍 96941 部隊(屬情報及網絡戰單位)撰寫的論文,披露他們曾將敏感軍事源碼輸入 OpenAI 的 GPT-3.5,獲取程式及行動的精煉摘要,之後再用這批內容訓練自家模型,務求最終工具可完全在中國軍方封閉網絡內運作,毋須依賴境外伺服器。
白宮、美國國防部、中國外交部、解放軍以及 OpenAI 對相關查詢均未有回應。
延伸閱讀:AI 基建熱︰發薪日貸款商孤注一擲 10 億美元,轉攻數據中心
張崑陽:軍方正「抄走」西方 AI 的推理能力
Sunny Cheung(張崑陽) 作為 Jamestown Foundation 研究員,分析了超過 60 篇相關論文。他指出,中國軍方科研團隊正有系統地「捕捉」西方大型模型的推理步驟,而不只是最終答案。
他在接受訪問時表示,這些研究成果將被用於監控、網絡戰及戰場決策支援。張崑陽形容,教會模型給出正確答案只是第一步,真正困難的是,如何把產出答案背後的推理鏈條「搬運」到一個更細小、更易部署的系統之中。
另外,中北大學(被視為與中國軍工體系關聯的院校)的研究人員,則利用 Anthropic 的 Claude 3 Haiku 生成合成訓練數據,用於開發社交媒體監察工具。Anthropic 表示,其並未在中國銷售 Claude 的商業存取權,且於伺服器端設有監控機制以標記違規使用情況,同時警告,一旦模型被「蒸餾」複製,原本內建的安全閘與防護機制往往會被剝離。
蒸餾門檻與出口管制缺口
AI 數據公司 Sapien 聯合創辦人 Trevor Koverko 指出,被「蒸餾」的模型整體能力仍弱於原始前沿系統。他在接受評論時形容,這更像是把部分選定能力「移植」到成本較低、由本地完全掌控的模型,而非真正擺脫對前沿 AI 的依賴。
與此同時,中國中央及地方政府近年持續投入資金,支持模型「輕量化」及邊緣運算,將補貼導向無人機、衛星及其他受算力和能耗限制的平台,推動 AI 能在前線和受限設備上落地。
圍繞「蒸餾」技術的政治壓力已累積數月。美國財長 Scott Bessent 7 月時威脅,將制裁被其部門認定為從事模型蒸餾的中國企業。初創公司 月之暗面(Moonshot) 則於上周否認其 Kimi K3 模型依賴該技術。北京方面則反擊稱華府奉行「AI 霸權主義」,並指摘美企同樣使用類似蒸餾手法。





