美AI模型成中國軍方捷徑?路透:解放軍「蒸餾」Claude、GPT發展國防AI
路透社報導,中國軍方研究人員已「蒸餾」美國人工智慧(AI)公司OpenAI與Anthropic的先進AI模型,用於訓練提升軍力的本土AI系統。這顯示,儘管華府限制中國取得先進晶片及其他戰略技術,但美國最先進的AI模型已成為中國軍方與國安機構開發自家專用系統的「捷徑」。
路透社是在檢視80多篇中國學術論文與專利後,發現上述情況。這些文件顯示,中方廣泛使用「模型蒸餾」(model distillation)的技術,亦即利用功能強大的AI系統輸出結果,訓練可在自家部署的較小規模、用途專一的模型。如此可不必從零開始打造尖端AI系統,省下龐大的運算資源。
路透社檢視的資料包括華府智庫詹姆士敦基金會(Jamestown Foundation)彙整的研究成果。調查顯示,中國解放軍及其他軍事機構研究人員都廣泛蒸餾美國的AI模型。
這些論文顯示,中國國防機構將美國頂尖AI模型視為技術知識的重要來源,也是縮小與美國差距的方法。
報導強調,此事的爭議不在於中方採用模型蒸餾技術(這是業界普遍採用的做法),而是中方未經授權就擷取美國AI模型。
分析60多篇論文的詹姆士敦基金會研究員張崑陽表示,中國軍事科學家正有系統地擷取西方AI模型的推理步驟,再加以改造,應用於監控、網路戰及戰術決策。他表示:「教會一個模型正確答案是一回事,但教會它推理過程要困難得多。」
張崑陽說:「這些論文顯示,中國軍方相關的研究人員正試圖將西方模型昂貴的專屬推理能力,移植到他們可以自行控制、且在本地部署的小型系統中。」
路透社進一步查證相關學術文獻,並另外辨識出約24個與軍方有關的案例。其中一篇論文在去年發表,由負責軍事情報與網路作戰的解放軍96941部隊研究人員撰寫。
該論文的研究人員利用OpenAI的GPT-3.5處理敏感軍事原始碼。研究人員表示,第三方AI模型並不適合直接處理機密資訊,因此他們利用GPT-3.5先對軟體程式碼進行摘要,再以這些摘要訓練中國本土模型,使其能完全在中國軍方內部網路運作。
白宮、美國國防部、中國外交部、解放軍及OpenAI均未回應路透社置評請求。
●從內容審查到軍事部署 模型蒸餾用途廣泛
路透社與詹姆士敦基金會檢視的論文顯示,中國研究人員利用模型蒸餾的用途涵蓋內容監控到軍事部署。
與中國軍工產業關係密切的山西省中北大學研究人員,就曾利用Anthropic的Claude 3 Haiku產生合成訓練資料,建立用於社群媒體監控與內容審查的文字分類模型。
Anthropic表示,該公司並未向中國或北京控制的企業提供Claude商業服務,已透過監控系統偵測違反政策的使用情況。Anthropic也指出,以「蒸餾」產生的模型可能失去原始系統的安全防護機制,使部分敏感能力被轉移到公司無法控制的模型上。
解放軍國防科技大學2024年的一篇論文則指出,研究人員利用模型蒸餾,將影像處理模型縮小至可部署於無人機,讓無人機即使在通訊中斷情況下,也能即時分析影像,支援導航及目標鎖定。
今年稍早發表的另一項研究則顯示,中國中國軍事科學院研究人員利用模型蒸餾,使目標辨識模型可在戰術硬體上運作,並於模擬海上作戰中支援無人機、軍艦及無人潛艇協同行動。