路透調查:中國軍方研究單位用OpenAI、Anthropic模型訓練國防AI
路透檢視逾80篇中國論文與專利,發現解放軍相關單位(含96941部隊、國防科大、軍事科學院)用「模型蒸餾」拿OpenAI、Anthropic模型的輸出訓練軍用AI,應用於無人機導航、目標識別、程式碼摘要等領域。
晶片與模型權重管制防得住直接複製,防不住透過公開API把推理能力「蒸餾」出去,這是出口管制目前堵不住的最低成本漏洞,也是中美AI治理談判的新引爆點。
路透檢視超過80篇中國學術論文與專利,發現解放軍相關研究單位大量使用「模型蒸餾」技術,拿OpenAI與Anthropic的前沿模型輸出來訓練自家的軍用AI系統。這不是單一個案。北京理工類院校、國防科技大學、軍事科學院、陸軍工程大學,加上代號96941的解放軍網戰與情報單位,全都在名單上。手法很直白:大模型太貴、太耗算力、也不能碰機密資料,那就讓它先示範一遍怎麼推理,再拿這些示範去教一個小模型,小模型就能塞進無人機、衛星、艦艇裡跑。國防科大用這招把影像辨識模型塞進無人機,讓它斷網時也能自己判斷航向與目標;軍事科學院拿去做海上無人艇群的目標識別;96941部隊甚至用GPT-3.5摘要敏感軍事原始碼,再用摘要訓練一個完全在解放軍內網運作的模型——理由很現實,機密資料不能直接餵給第三方模型,但摘要可以。
這裡的關鍵不是蒸餾這個技術本身——業界都在用,OpenAI、Google自己也蒸餾自家模型。爭議在於:美方管制的是晶片與模型的直接取得,但蒸餾繞過的正是這道防線。你不需要偷到模型權重,只需要能呼叫API、拿到輸出,就能把裡面「昂貴、專有的推理能力」榨出來,裝進一個算力需求低到能塞進戰術硬體的小模型。這解釋了為什麼中國政府這幾年拚命補貼「模型輕量化」與邊緣運算——晶片出口管制卡住的是造大模型的算力,蒸餾卻讓你不需要造大模型,只需要會偷師。Jamestown研究員程翔說得直接:教模型答對是一回事,教它「為什麼這樣答」的推理鏈才是難的部分,而這正是解放軍系統性想抓的東西。
中方的反駁邏輯也不令人意外:北京說華盛頓在搞AI霸權主義,還說美國公司自己也蒸餾別人的模型——Moonshot上週才否認Kimi K3是靠蒸餾OpenAI模型做出來的。但這場口水戰的真正意義,是它把AI出口管制的漏洞攤在檯面上,成了中美AI治理談判前的引爆點。管制晶片、管制模型權重,防得住直接複製;防不住的是「你回答我一百萬次,我就學會你怎麼想」這種蒸餾式偷師,而這正好是門檻最低、成本最省的路徑。
專家也點出蒸餾的天花板:被蒸餾出來的小模型只繼承部分能力,不是前沿模型的複製品,Anthropic也提醒蒸餾會讓原本的安全防護一併流失。換句話說,中國軍方拿到的不是等同GPT或Claude的完整智能,而是「夠用」的局部能力——但對戰術無人機導航、目標識別這類任務,夠用往往就已經足夠。這才是真正該讓決策者在意的地方:出口管制擋得住硬體,擋不住透過公開API洩漏出去的推理能力,而後者恰恰是最難被一紙禁令堵住的缺口。
訂閱品富智圖 AI 新聞
每日 AI 產業要聞彙整,一封信直送信箱。
