開放權重模型競爭格局:中國已穩居領先,美國如何應對
根據作者為美國國會準備的簡報,中國開放權重模型在技術評測與使用量上均領先美國:AAII 能力指數榜首三名全為中國模型(分數 44–45),最強美國開放模型僅得 26 分;Hugging Face 下載量中國領先約 16 億次;OpenRouter 平台上中國模型佔開放模型使用量逾 80%;AI 學術論文引用中國開放模型的比例(40%+)已超過美國(30%)。
開放模型正成為前幾名閉源大廠以外所有人的 AI 基礎設施,誰主導這層,誰就掌握全球研究方向與應用生態的話語權;目前中國實驗室已在學術與商業端建立起難以輕易切換的依賴,即便美國試圖管制流通,首先受損的反而是美國自己的企業與研究社群。
每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。
這是一份為美國國會簡報準備的分析備忘錄,作者是曾主持 Allen Institute for AI 旗下 OLMo 模型計畫的研究員。內容聚焦於一個核心判斷:在開放權重模型這個賽道上,中國已是無可爭議的領先者,而且領先優勢還在擴大。
數字把格局說得很清楚。在 Hugging Face 的下載量上,中國從 2025 年 7 月開始超越美國,目前領先幅度約 16 億次,中美合計 32 億次下載中,中國佔了一半以上。在 Artificial Analysis Intelligence Index(AAII)能力評測上,榜首三名全是中國模型——Z.ai 的 GLM-5.3、GLM-5.3-Flash 和 Moonshot AI 的 Kimi K3,分數分別是 45、42、44;相比之下,最強的美國開放模型 Thinking Machines 的 Inkling 只有 26 分,差距約 2 到 6 個月。學術界的訊號更直接:AI 論文在 arXiv 上提及中國開放模型的比例已超過 40%,超越美國的 30%,其中阿里巴巴 Qwen 系列在最新統計中被提及的比率達 30%,Meta Llama 則跌至 21%。

這個差距是怎麼來的?作者給出幾個解釋,但也明確排除了一個常見說法的份量。中國實驗室發布速度更快、任務分布更集中,讓它們在公開評測上佔了一定便宜;它們也確實在使用「蒸餾」技術——也就是拿美國閉源模型的輸出來訓練自己的模型。但作者估計,即使蒸餾被完全阻斷,中美開放模型的差距頂多縮小 1 到 2 個月。換句話說,蒸餾不是故事的全部,中國實驗室的模型本身就是真實力。與此同時,中國頭部實驗室也在改變策略:2026 年上半年還偏好自建數據工作流,下半年已開始向美國和中國新創公司購買高品質訓練數據,尤其是代理任務的強化學習環境。
市場採用面的訊號同樣值得重視。OpenRouter 這個跨模型推理平台的數據顯示,中國模型目前佔開放模型使用量的 80% 以上,從 2025 年 9 月到現在,平台每週處理的開放模型 token 量從約 1 兆暴增至 80 兆。Harvey(法律)、Cursor(程式開發)、DoorDash(使用 Kimi)、Airbnb(使用 Qwen)、Perplexity(使用 DeepSeek)都已是中國模型的商業用戶,而這只是冰山一角——矽谷大量早期新創正在悄悄把中國模型當作低成本基礎設施,部分公司甚至直接與中國實驗室簽訂企業授權協議,作者稱之為「我職涯中從未見過的跨境技術合作新形態」。
這件事的產業意涵,遠不只是一場技術排名的消長。開放權重模型正在成為 AI 能力擴散的基礎設施——對於前幾名閉源大廠(OpenAI、Anthropic)以外的所有人來說,開放模型就是他們能用到的實際工具。誰主導這層基礎設施,就掌握了軟實力、研究方向,乃至下一代 AI 應用的發展路線。目前的局面是:中國實驗室通過開放策略,已在全球學術圈和商業生態中建立了相當難以撼動的依賴。作者也點出一個結構性困境:若試圖管制中國強模型的流通,首先受到拖累的反而是美國企業——HuggingFace 本身在應對資安攻擊時,正是因為閉源模型拒絕配合,才轉而用中國開放模型來分析。
美國並非毫無反擊機會。OpenAI 發布首個開放權重模型 gpt-oss 之後,成了有史以來採用率最高的開放模型之一;Google Gemma 4 也是少數能在下載量上與 Qwen 小模型抗衡的美國模型。但這些亮點是例外,不是趨勢的逆轉。中國實驗室在全球研究採用和企業簽約上繼續擴張,而美國在這個賽道上投入的資源,還沒有轉化成系統性的反超。開放模型主導權這場仗,現在打的已經不只是技術分數,而是誰能成為其他所有人建東西的那塊地基。
看完今天的,讓明天的自己送上門
每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。
已出刊 131 期 ・ 隨時可退訂

