日報
AI 產業新聞
每日更新

全球人工智慧產業每日要聞 — 由黃紹麟編選摘要,每天從 100 多則新聞精選 6 則。

79
累積集數
644
則深度解讀
6
大追蹤分類

智譜開源模型 GLM-4.5 僅需 8 顆 H20 運行,推理成本低於 DeepSeek

2026-06-06 · 來源:tw.stock.yahoo.com

中國 AI 公司智譜(Z.ai)於 6 月 28 日發布開源模型 GLM-4.5,主打比 DeepSeek 更低的使用成本,並聲稱只需 8 顆輝達 H20 晶片即可運行。這是繼 DeepSeek 之後,中國第二波低成本開源模型浪潮中值得正視的一筆。

核心數字擺在這裡:GLM-4.5 輸入每百萬 token 收費 11 美分,輸出每百萬 token 收費 28 美分;相較之下,DeepSeek R1 的輸入費率是 14 美分、輸出費率是 2.19 美元。輸出端的差距尤其懸殊——GLM-4.5 的輸出成本約為 DeepSeek R1 的八分之一。智譜執行長張鵬表示,GLM-4.5 的參數規模約為 DeepSeek 的一半,但他拒絕透露訓練成本,僅說細節稍後公布。

架構上,GLM-4.5 採用「代理式(agentic)」設計,模型會自動將任務拆解為子任務再分頭處理,這與傳統單輪問答邏輯不同,更接近複雜工作流的實際需求。開源授權讓開發者可免費下載使用,這一點同樣沿襲了 DeepSeek 的商業邏輯——以成本優勢搶佔開發者生態,再以 API 調用換取規模收入。

對亞太市場的決策者而言,這件事有幾層值得拆解的意涵。

第一,H20 晶片的角色正在被重新定義。H20 是輝達針對中國市場推出的降規晶片,算力遠不及 H100 或 H200,但智譜能用 8 顆 H20 跑起一個具商業競爭力的推理模型,這代表中國 AI 公司在有限算力下的工程優化能力持續提升。值得注意的是,張鵬表示智譜目前算力充足、不需追加採購,這句話若屬實,意味著晶片管制對部分中國 AI 公司的邊際約束正在減弱——不是因為限制鬆動,而是因為模型效率本身在跑贏硬體需求。

第二,中國開源模型的價格競爭已從「顛覆美國」的單點事件,演變成持續性的系統壓力。本月同期,阿里巴巴支持的 Moonshot 也發布了 Kimi K2,輸入費率 15 美分、輸出費率 2.5 美元。GLM-4.5、Kimi K2 與 DeepSeek 三家的輸出費率分別是 0.28、2.5、2.19 美元,差距仍大,競爭格局尚未收斂。但趨勢方向明確:中國開源模型的推理成本底線正在被一再下修,而且下修速度快於市場預期。

第三,對使用 AI API 的企業應用開發者而言,這場競爭帶來的直接影響是選擇變多、議價空間變大。當輸出成本的量級差異來到 8 倍,用量大的場景(客服、文件處理、程式輔助生成)的成本結構就必須重算。這對台灣、東南亞的 SaaS 公司與系統整合商尤其直接。

需要保留的疑問是:智譜刻意迴避訓練成本的披露,GLM-4.5 在各項 benchmark 上的表現數據也尚未在文章中出現,因此「比 DeepSeek 更省」目前是定價層面的事實,而非全面能力的結論。模型能力的實際落差,仍有待獨立評測驗證。

低成本開源模型的競爭在中國本土已進入常態化,下一個問題不是誰更便宜,而是誰能在成本之外建立差異化——agentic 架構或許是智譜想押注的那張牌。

原文出處
原文標題 比DeepSeek更省!中國最新開源AI模型僅用8顆H20晶片震撼公開
媒體來源 tw.stock.yahoo.com
發布日期 2026-06-06
閱讀原文 ↗

訂閱品富智圖 AI 新聞

每日 AI 產業要聞彙整,一封信直送信箱。