日報
AI 產業新聞
每日更新

全球人工智慧產業每日要聞 — 由黃紹麟編選摘要,每天從 100 多則新聞精選 6 則。

79
累積集數
644
則深度解讀
6
大追蹤分類

智谱、MiniMax、DeepSeek、Qwen 單週密集更新,中國大模型競爭進入月更節奏

2026-05-29 · 來源:segmentfault.com

2025年2月中旬,中國主要大模型在一週內密集發布更新:智谱 GLM-5 正式推出、MiniMax M2.5 開放內測、DeepSeek V4 進入灰度測試,阿里 Qwen 3.5 預告即將發布,月之暗面 Kimi K2.5 也在此前完成迭代。這波更新的密度本身就是一個信號——中國頭部模型廠商已從雙月一版的節奏壓縮到月更,軍備競賽的頻率正在追平產品迭代能力的上限。

從技術規格看,GLM-5 是這批更新中參數規模躍升最明顯的一個,從 GLM-4.7 的 355B 直接擴到 744B,訓練資料也從 23T 增至 28.5T tokens。定位上,智谱刻意從「VibeCoding」轉向「Agentic Engineering」,意圖切入的是多步驟任務與 Agent 系統工程這塊市場,而非只是輔助寫程式的副駕角色。外部評測顯示其分數超過 Gemini 3 Pro,是目前開源模型中最高分——但算力緊張、需要排隊這件事,說明供給側還沒跟上需求。

MiniMax M2.5 的訴求更直接:主打編程能力,內測期間提供無限 token。有用戶測試將 Go 微服務轉寫為 Rust,消耗 3 億 token、生成 3 萬行程式碼。「與 Claude Opus 4.6 打得有來有回」的用戶反饋,雖然是非正式評測,但對於開發者社群的傳播具有實際影響力。

Kimi K2.5 的競爭策略則與上述兩者完全不同——它打的是成本牌。有用戶從 Claude Sonnet 4.5 切換過來後,日費用從 50 美元降至 4 美元,降幅超過 90%。這個數字對於 API 使用量大的中小型開發團隊而言有直接決策意義。長文本處理方面也獲得正面回饋,但回應速度被部分用戶點名批評。

DeepSeek V4 目前仍在灰度測試階段,當前釋出的 200B 版本並非正式 V4,僅是過渡版本。主要特點是支援 100 萬 token 上下文、知識截止日期更新至 2025 年 5 月。用戶回報程式碼生成能力優於 V3.2,但前端能力仍不及 Kimi K2.5。Qwen 3.5 尚未發布,但延續前幾代開源友好的路線,主要受眾是需要本地部署的企業與開發者。

從產業競爭格局來看,這輪更新有幾件事值得注意。第一,各家模型的差異化方向已開始分化:GLM-5 往 Agent 工程走,MiniMax M2.5 押注編程專業化,Kimi K2.5 打性價比,Qwen 系列守開源生態。這表示正面硬拚通用能力的階段正在過去,垂直定位開始成為主要競爭維度。第二,Claude 在中國開發者社群的替代效應開始出現實際數據——無論是成本對比還是編程能力的逐項比較,Claude 都成為本土模型對標的基準,這對 Anthropic 在亞太市場的商業策略具有參考意義。第三,這批模型集中在農曆新年後爆發,時間節點與開發者重返工作狀態高度吻合,不排除各家廠商刻意選擇這個視窗期製造話題聲量。

對亞太地區的企業技術決策者而言,這輪密集更新的實際意義在於:採購或整合中國大模型的評估週期需要縮短,因為三個月前的評測結論可能已經過時。月更節奏也意味著廠商的工程資源正在高度繃緊,服務穩定性(GLM-5 的算力排隊問題即為一例)將成為選型時不可忽略的變數。

原文出處
原文標題 人工智能- 2.12国产大模型集体更新,一文看懂怎么选
媒體來源 segmentfault.com
發布日期 2026-05-29
閱讀原文 ↗

訂閱品富智圖 AI 新聞

每日 AI 產業要聞彙整,一封信直送信箱。