多項研究顯示,中國軍方研究人員正利用 OpenAI 與 Anthropic 模型產出的內容,訓練本土國防系統。一份彙整逾 80 篇學術論文與專利的最新評估指出,相關作法已在多家與解放軍關聯的機構中系統化展開。
重點整理:
- 檢視逾 80 篇中國論文與專利後發現,多家與軍方有關的機構正將美國前沿大模型「蒸餾」為本地小型系統。
- 解放軍某網路戰部隊曾將具敏感性的軍事原始碼餵給 GPT-3.5,再用其摘要訓練本土模型。
- Anthropic 表示未在中國提供商用存取,並警告蒸餾後的複製模型可能失去原始安全防護。
逾 80 篇中國論文揭示「模型蒸餾」現況
這份由部分華府智庫 Jamestown Foundation 共同整理的研究,經檢閱中國大量學術論文與專利後,揭露多所與解放軍有關的院校與研究單位,普遍採用所謂「模型蒸餾」技術。報導並指出,評估團隊另外鎖定約兩打具軍事色彩的實際應用案例。
文件描述的「模型蒸餾」,是指先利用大型且運算昂貴的前沿系統產生輸出,再把這些輸出當作訓練資料,轉化為可在中低階硬體上運作的小型模型。
其中一篇出自北京的解放軍 96941 部隊——一個負責情報與網路作戰的單位——的論文,披露他們曾將具高度敏感性的軍事軟體原始碼提供給 OpenAI 的 GPT-3.5,並保留其產生的程式分析與摘要。研究團隊接著以這些內容訓練本土模型,使最終工具能完全部署在解放軍內部網路,無須往返境外伺服器。
對於上述評估與個案,美國白宮、五角大廈、中國外交部、解放軍及 OpenAI 均未回應置評要求。
延伸閱讀: AI 基礎設施:發薪日放款業者押注 10 億美元孤注一擲搶攻資料中心
張崑陽:中國在「偷走推理過程」
分析逾 60 篇相關論文的 Jamestown 研究員 張崑陽(Sunny Cheung) 指出,中國軍方科學家正有系統地「捕捉並複製」西方 AI 系統的推理步驟,而不只追求最終答案。
他向記者表示,這些研究成果已被導入監控、網路戰及戰術決策支持等多項應用。張崑陽強調,讓模型「知道正確答案」是一回事,要把產出該答案的推理鏈條萃取並移植到更小的系統,技術門檻則高得多。
在與中國軍工體系關係密切的中北大學,研究團隊則使用 Anthropic 的 Claude 3 Haiku 產生大量合成訓練資料,用於開發社群媒體監控工具。Anthropic 表示,該公司未在中國境內銷售 Claude 的商用存取權,並在全球部署多層監測機制偵測違規使用,同時警告經蒸餾複製的模型很可能喪失原本內建的防護閥值與安全設計。
蒸餾技術極限與出口管制縫隙
AI 資料公司 Sapien 共同創辦人 Trevor Koverko 指出,蒸餾後的模型依然明顯弱於原始前沿系統。他在接受訪問時表示,這比較像是把部分關鍵能力「移植」到成本較低、完全受本地控制的模型,而非真正擺脫對先進美製 AI 的依賴。
與此同時,中國中央與地方政府持續加碼補貼「模型輕量化」與邊緣運算,資金明確導向能在無人機、衛星及其他受限終端設備上執行的軟體與推理模型。
針對這類技術操作的政治壓力已累積數月。美國財政部長 Scott Bessent 今年 7 月曾放話,將考慮制裁被認定大量從事 AI 蒸餾行為的中國企業。中國新創 Moonshot 則於上週否認其 Kimi K3 模型仰賴此法訓練;北京方面則反指華府推動「AI 技術霸權」,並點名多家美企同樣在使用類似蒸餾技術。






