:::

產業新聞

中國軍事 AI 向 GPT、Claude取經 蒸餾模型用於無人機與海上作戰模擬【轉載自INSIDE】

2026-08-03 00:00

《路透社》報導,中國軍事研究人員曾利用 OpenAI、Anthropic 等美國企業的 AI 模型訓練可在軍方內部網路、無人機及戰術設備上運作的中國模型,應用範圍涵蓋軍事軟體原始碼處理、網路戰、社群監測、無人機導航及海上目標辨識。

《路透社》檢視超過 80 篇中國學術論文與專利後發現,與中國人民解放軍及其他軍事機構有關的研究人員,正利用「模型蒸餾」(model distillation)技術,把美國先進 AI 模型的部分能力轉移至規模較小、可由軍方自行控制的系統。

檢視的資料包括華府智庫詹姆斯敦基金會(Jamestown Foundation)彙整並獨家提供的研究。該基金會研究員 Sunny Cheung 分析超過 60 篇論文後指出,中國軍事科學家正有系統地擷取西方模型的推理步驟,並嘗試把相關能力應用於監控、網路戰及戰術決策。《路透社》另外驗證並找出約 24 個與軍方有關的案例。

模型蒸餾是利用強大模型產生的答案、摘要或合成資料,訓練規模較小的專用模型。經過蒸餾的模型需要的運算資源較少,可直接部署於本地端,省下從零打造尖端 AI 系統所需的龐大算力。

GPT-3.5 摘要敏感軍事程式碼,Claude 生成社群監控訓練資料
中國人民解放軍 96941 部隊研究人員去年發表的論文顯示,該團隊曾利用 OpenAI 的 GPT-3.5 處理敏感軍事軟體原始碼。該部隊位於北京,負責軍事情報與網路戰。

研究人員認為,第三方模型不適合處理機密資訊,因此先以 GPT-3.5 摘要軟體程式碼,再利用相關摘要訓練中國模型,使最終系統能完全在中國軍方內部網路運作。

與中國武器工業關係密切的中北大學,也曾使用 Anthropic 的 Claude 3 Haiku 產生合成訓練資料,訓練用於社群媒體監測及內容管理的文字分類模型。

Anthropic 表示,該公司未在中國提供 Claude 的商業使用管道,也未向北京控制的企業提供服務,並會透過監測系統偵測違反政策的行為。

Anthropic 也警告,模型在蒸餾過程中可能學會原始系統的敏感能力,卻未一併繼承原有的安全防護,導致 Anthropic 無法管控這些能力如何被使用。

通訊中斷仍能分析影像,蒸餾模型部署無人機與戰術硬體
中國人民解放軍國防科技大學 2024 年發表的一篇論文,描述研究人員如何透過蒸餾縮減影像處理模型,再將模型部署於無人機。即使通訊中斷,無人機仍能即時分析影像,協助導航及目標選定。

中國人民解放軍軍事科學院也曾把蒸餾後的目標辨識模型安裝在戰術硬體上。今年稍早發表的研究顯示,該模型曾用於涉及無人機、船艦及無人潛艦的模擬海上行動。

模型蒸餾是業界常見技術,未經授權擷取能力引發美中爭議
模型蒸餾是 AI 產業常見技術,美方的爭議焦點集中在部分中國實體可能未經授權擷取美國模型能力,進而削弱先進晶片出口管制成效,或侵犯智慧財產權。

在美中準備舉行 AI 治理與安全談判之際,相關問題已成為雙方主要爭議。中國否認美方指控,批評華府追求 「AI 霸權主義」,並主張美國企業也曾採用相似做法。

中國 AI 開發商也否認其技術進展依賴外國模型。月之暗面(Moonshot AI)上週反駁川普政府的指控,表示旗下 Kimi K3 模型並未透過蒸餾打造,相關能力來自公司的自有技術創新。

算力受限加速模型輕量化,中國也開始防範能力遭擷取
在美國限制先進晶片出口後,中國取得高效能運算資源的管道受到限制。中國中央與地方政府因而推動「模型輕量化」及邊緣運算,並提供補助與研究經費,發展能在無人機、衛星及其他運算能力有限裝置上運作的 AI 模型。

不過,蒸餾模型只能繼承經過選擇的能力,無法完整複製前沿模型的整體智慧。AI 資料公司 Sapien 共同創辦人 Trevor Koverko 表示,蒸餾可把特定能力轉移到成本較低、可在本地控制的系統,仍無法讓開發者完全擺脫對前沿 AI 的依賴。

中國軍方也開始研究蒸餾可能帶來的安全威脅。中國人民解放軍陸軍工程大學研究人員今年 1 月發表論文,分析「無資料蒸餾」(data-free distillation)的風險。這種方法能在無法直接取得模型內部參數的情況下,透過公開輸出內容反向解析模型能力。該研究團隊也提出多種防禦機制,希望遮蔽模型公開輸出所透露的隱藏邏輯資訊,降低能力遭到外部擷取的風險。

責任編輯:Sisley
核稿編輯:Mia

更新日期:113-06-30 /  回上一頁