根據對逾 80 篇中國學術論文與專利的最新評估,中國軍方研究人員已利用 OpenAI 與 Anthropic 模型輸出結果,訓練本土國防系統與軍用 AI。
重點摘要:
- 評估逾 80 篇中國論文與專利後發現,多家與軍方有關機構,正把美國前沿大模型「蒸餾」為可在本地運行的小型系統。
- 解放軍一支網路戰部隊曾向 GPT-3.5 輸入敏感軍事原始碼,再以其產出的摘要訓練國產模型。
- Anthropic 表示未在中國提供商業存取,並警告經蒸餾複製的模型可能喪失原有安全防護機制。
逾 80 篇論文揭示的「模型蒸餾」樣態
這份評估部分與總部位於華府的 Jamestown Foundation 合作,並透過多份中國學術論文與專利,系統性整理相關案例。報告指出,多所與解放軍關係密切的研究機構,均涉入這類操作,研究團隊額外點名約兩打具軍方背景的應用個案。
文獻多次提及的技術核心為「模型蒸餾」(model distillation):透過讓大型、運算密集的大模型輸出答案,再以這些輸出結果作為訓練資料,打造可在較低階硬體上運作的小型模型。
其中一篇出自位於北京、被視為軍事情報與網路作戰單位的解放軍 96941 部隊。該論文描述,研究人員曾向 OpenAI 的 GPT-3.5 輸入敏感軍事原始碼,保留其產出之摘要,再以此作為訓練資料,打造國產模型。最終成品可在中國軍方內部網路獨立運行,避免依賴境外伺服器。
白宮、美國國防部、中國外交部、解放軍以及 OpenAI 均未就此回應媒體查詢。
延伸閱讀:AI 基礎建設:發薪日貸款商絕地反攻,砸 10 億美元豪賭資料中心轉型
張峻陽:軍方正「偷走」西方模型的推理鏈
Jamestown 研究員 Sunny Cheung(張峻陽) 分析超過 60 篇相關論文後指出,中國軍方科研團隊正有系統地「捕捉」西方 AI 系統的推理過程,而不僅是最終答案。
他在接受訪問時表示,這些研究直接服務於監控、網路戰與戰術決策支援等軍事領域。張峻陽強調,讓模型學會「正確答案」相對容易,但要把背後的「推理鏈」轉移到更小、更可控的本地模型上,難度與戰略價值都高得多。
此外,與中國軍工體系關係密切的中北大學研究團隊,被發現曾利用 Anthropic 的 Claude 3 Haiku 產生「合成訓練數據」,用於社群媒體監控工具的開發。Anthropic 表示,未在中國境內提供 Claude 的商業存取,並在境外部署違規監測機制;該公司同時警告,一旦模型被蒸餾複製到第三方系統,原本內建的安全防護可能大幅弱化甚至消失。
蒸餾技術的極限與出口管制灰區
AI 數據公司 Sapien 共同創辦人 Trevor Koverko 指出,經蒸餾後的模型整體能力仍顯著弱於原始前沿系統。他在接受訪問時形容,這更像是把部分關鍵能力「轉植」到一個成本較低、由本地完全掌控的模型,而非真正擺脫對前沿 AI 的依賴。
與此同時,中國中央與地方政府近年大舉補貼「模型輕量化」與邊緣運算技術,資金多流向可部署在無人機、衛星與其他受限載具上的軟體方案,強調在資源有限的前線設備上運行 AI 功能。
外界對模型蒸餾的疑慮已累積數月。美國財政部長 Scott Bessent 今年 7 月曾放話,將鎖定被視為從事此類蒸餾行為的中國企業祭出制裁。中國新創 Moonshot 上週則否認其 Kimi K3 模型仰賴這一技術。北京方面則反批華府追求 AI 霸權,並指出美國企業在商業應用中也廣泛採用類似技術。





