近年來,美國政府嚴格限制本國科技企業向中國出口先進晶片與人工智慧(AI)技術。然而,中國人民解放軍及其相關研究機構,已成功找到一條隱蔽的「捷徑」,使中國能在各項限制之下,持續進行研發與技術研究。

路透社與華府智庫「詹姆斯敦基金會」(Jamestown Foundation)合作,共同檢視超過80份中國的學術論文與專利報告後發現,隸屬解放軍的研究人員,正大規模運用由美國大型企業開發的AI模型(如最常見的OpenAI與Anthropic),採用「模型蒸餾」(Model Distillation)技術,輸入關鍵提示或指令,讓這些AI平台產出高品質的邏輯推理,並逐步萃取精煉,用以訓練規模較小、更具專門性的本土語言模型,進而提升實際國防戰力。

調查發現,中國軍方研究員與民間新創企業類似,廣泛使用「模型蒸餾」技術。他們將關鍵提示或指令輸入GPT-4或Claude等高階AI模型,利用這些平台生成高品質的邏輯推理,再一步步萃取與精煉,用來訓練規模更小、更有效率的本土語言模型。

如此一來,中國無需耗費巨額算力與晶片採購成本,從零開始研發前沿模型,即可讓本土小型AI模組具備高度判斷能力,並直接部署於軍用硬體設備上。

詹姆斯敦基金會研究員張崑陽(Sunny Cheung)指出:「訓練模型產出正確答案是一回事,但其背後的『邏輯推理』,要比前端訓練困難更多。這些論文顯示,解放軍正有系統地捕捉西方模型的推理能力,並將其轉化為可由中方控制、部署於軍事網路的小型系統,擴大運用於監控、網路戰與戰術決策之上。」

報導同時揭露解放軍多項實際應用案例:

- 解放軍96941部隊(軍事情報與網路戰部隊):研究人員曾使用OpenAI的GPT-3.5模型,處理敏感的軍事原始碼。由於西方雲端模型無法直接運行於機密網路,他們先利用GPT-3.5提煉軟體程式碼摘要,再以此訓練本土模型,使其能在解放軍內部封閉網路中自主運作。

- 中北大學(與兵器工業緊密相關):使用Anthropic研發的Claude 3 Haiku,生成訓練數據,用於開發執行社群監測與內容審查的分類語言模型。

- 國防科技大學(NUDT):2024年的一份論文描述,利用模型蒸餾將影像處理模型極小化,再投入到軍用無人機(UAV)身上。讓無人機能夠在通訊被外界干擾或切斷的情況下,依然能夠透過AI執行即時動態影像分析,進行自主導航與打擊目標。

- 軍事科學院(AMS):在模擬的海上無人艇、艦艇與無人潛艦協同作戰中,利用蒸餾模型,在戰術硬體上執行目標識別。

這項發現,也引發美中兩國在AI治理與安全上的激烈角力。美方指控北京透過未經授權的蒸餾萃取技術,侵犯美國企業智慧財產權,並規避出口管制;中國則反駁華府,指責對方大搞AI霸權,並強調當前知名的中國AI新創企業,如Moonshot的Kimi模型,全都是自主創新產品。

在得知自家模型被用於蒸餾後,Anthropic回應表示,該公司從未授權中國或受北京控制的企業商業使用Claude,且平台設有監控機制,可檢測任何可能的違規行為。

FACT BOX · 重點整理

  • 來源:PR Times
  • 分類:調查
  • 相關組織:OpenAI / Anthropic / Moonshot
  • 原文日期2024年
  • 產品、服務:GPT-4 / Claude 3 Haiku