日報
AI 產業新聞
每日更新

全球人工智慧產業每日要聞 — 由黃紹麟編選摘要,每天從 100 多則新聞精選 6 則。

130
累積集數
950
則深度解讀
6
大追蹤分類

Mistral 發布 1 兆參數旗艦模型 Large 4,三週內將開放權重下載

2026-10-07 · 來源:TechCrunch AI
幫你做功課
發生什麼事

Mistral AI 本週發布 Mistral Large 4(ML4),總參數 1 兆,暱稱「Le Chonk」;目前只開放公開端點存取,三週後安全測試完成才釋出開放權重。訓練僅用 4,000 張 Nvidia GPU,約為中國競爭對手的三分之一至二分之一。優化場景包括網路安全、金融與晶片設計;Series D 由三星領投,估值 210 億歐元(約 244 億美元)。benchmark 結果尚未公布。

為什麼重要

ML4 是 Mistral 對「只是推論服務商」質疑的正面反擊,用更少算力訓練旗艦模型、鎖定企業與政府客群,是歐洲在開閉源之爭中最具體的一步棋;但 benchmark 尚未驗證,三週後開放權重才是真正的市場考驗。

每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。

開源與閉源的對決,歐洲還沒出局。法國 AI 實驗室 Mistral AI 本週發布 Mistral Large 4(ML4),總參數 1 兆,內部暱稱「Le Chonk」,目標是同時超越美國閉源模型與中國開源模型,呼應馬克宏所說的「AI 第三條路」。

ML4 目前只能透過公開端點存取,三週後安全測試完成,才會釋出開放權重。這個時序不是隨便定的。Mistral 副研究長 Pierre Stock 表示,他們會先與信任的合作夥伴及各國政府合作,確認開源權重能用於防禦,而非惡意攻擊。換句話說,ML4 現在是「半開放」的狀態——比閉源模型透明,比完全開放多一道緩衝。背後有現實考量:Mistral 的核心客群是企業與政府機構,這些買家對資安疑慮越來越敏感,但同時也需要可審計的模型。

Mistral 發布 1 兆參數旗艦模型 Large 4,三週內將開放權重下載

訓練效率是 ML4 另一個值得注意的數字。Stock 說,整個訓練過程只用了 4,000 張 Nvidia GPU,是中國競爭對手的三分之一到二分之一,更遠低於閉源模型陣營。在算力軍備競賽打得如火如荼的當下,用更少的 GPU 訓練出旗艦級模型,代表的不只是成本控制——它說明了 Mistral 在訓練方法上確實有自己的一套,而不是靠堆算力硬來。不過,ML4 的 benchmark 結果尚未公布,Mistral 說「希望成為中國以外開放權重模型中最強的」,目前仍是自我宣告,有待第三方驗證。

從商業角度看,ML4 設定的優化場景包括網路安全、金融與晶片設計。最後這一項耐人尋味——Mistral 的兩大金主恰好都是晶片相關業者:Series C 由荷蘭半導體設備巨頭 ASML 領投,Series D 由三星領投,讓 Mistral 估值達到 210 億歐元(約 244 億美元)。一個法國 AI 實驗室,靠歐洲與亞洲的半導體資本支撐,訓練出一個強調晶片設計應用的旗艦模型,這條路線不算意外。Mistral 之前曾被外界質疑,代管中國模型是否代表它正在變成純粹的推論服務商。ML4 的發布,是它對這個質疑的正面回應:我們還是前沿實驗室,不只是跑模型的中間商。能不能守住這個位置,三週後開放權重時才是真正的考驗。

電子報訂閱 ・ NEWSLETTER

看完今天的,讓明天的自己送上門

每天精選 6 則要聞、一則產業名人訪談,五分鐘跟上。

已出刊 130 期 ・ 隨時可退訂

原文出處
原文標題 Mistral’s new 1T model aims to leapfrog closed and open rivals
媒體來源 TechCrunch AI
發布日期 2026-10-06
閱讀原文 ↗