一項覆蓋逾 80 份中國學術論文和專利的最新評估顯示,內地軍方研究人員正廣泛利用 OpenAI 和 Anthropic 等美國大型語言模型的輸出,來訓練本土國防 AI 系統,涉事機構與解放軍有緊密聯繫。
重點摘要:
- 檢視超過 80 份中國論文及專利,發現多間涉軍科研機構,正把美國前沿模型「蒸餾」成較小型的本土系統。
- 解放軍一支網絡戰部隊曾向 GPT-3.5 輸入敏感軍事源碼,再以其摘要訓練國產模型。
- Anthropic 指出未在中國提供商業存取服務,並警告經「蒸餾」後的模型或失去原有安全防護。
跨逾 80 篇論文的模型「蒸餾」實況
這次評估部分由設於華盛頓的 Jamestown Foundation 參與整理,並在多份文件中揭示相關做法,涉及多家與人民解放軍關聯的科研單位。評估人員額外點名了約兩打軍方背景的實際應用個案。
文件詳細描述所謂「模型蒸餾」(model distillation)技術:利用一個高性能大型模型輸出的結果,作為訓練數據,去打造可在較低成本硬件上運行的小型模型,將部分能力「壓縮」下放至邊緣設備。
當中一篇由駐北京、屬軍事情報及網絡作戰單位的解放軍 96941 部隊撰寫的論文,披露研究人員曾向 OpenAI 的 GPT-3.5 輸入帶有敏感軍事資訊的源碼,保留其生成的技術摘要,再以這批內容訓練國產模型。相關工具最後可完全在解放軍內部網絡運作,毋須連接任何境外伺服器。
白宮、美國國防部、中國外交部、解放軍以及 OpenAI 均未就報道回應置評。
延伸閱讀:AI 基建:發薪日貸款商鋌而走險,以 10 億美元豪賭數據中心轉型
張崑陽:軍方鎖定「推理鏈」以重塑西方 AI 思維
Jamestown 研究員 張崑陽(Sunny Cheung) 分析了當中逾 60 篇論文,他指出,中國軍方科學家正有系統地捕捉和重建西方 AI 系統的「推理過程」。
他向記者表示,相關研究主要服務於監控與情報收集、網絡戰能力以及戰場戰術決策支援。張崑陽形容,教會模型給出「正確答案」並不困難,真正棘手的是把產出背後的推理邏輯,壓縮進一個規模更小、可在本地獨立運作的系統裡。
另一個例子來自與中國軍工產業關聯緊密的中北大學。研究人員使用 Anthropic 的 Claude 3 Haiku 生成合成訓練數據,用於一套社交媒體監測工具。Anthropic 回應稱,未在中國販售任何 Claude 商業存取權,並強調公司設有合規監察機制,以標記違規用途,同時警告指,一旦模型被第三方「蒸餾」複製,原本內建的安全防護和限制功能可能被大幅削弱。
蒸餾效能有限 暴露出口管制灰區
AI 數據公司 Sapien 聯合創辦人 Trevor Koverko 表示,被「蒸餾」後的模型,整體能力仍遠遜原始前沿系統。他在接受訪問時指出,這種做法實際上是把部分篩選過的能力,移植到一個更廉價、完全由本地控制的模型,而非真正擺脫對國際前沿 AI 的依賴。
與此同時,中國中央及地方政府近年積極資助模型輕量化及邊緣運算技術,政策和補貼重點傾斜至可部署於無人機、衛星及其他資源受限裝置上的軟件方案,為軍民兩用的邊緣 AI 打基礎。
圍繞蒸餾技術的爭議已醞釀多月。美國財長 Scott Bessent 今年 7 月曾威脅,將對被認定大量從事蒸餾行為的中國企業實施制裁。內地初創 Moonshot 上周否認旗下 Kimi K3 模型仰賴該技術,而北京方面則反指華府推行「AI 霸權主義」,並強調類似做法在美企同樣常見,質疑美國採取「雙重標準」。






