日報
AI 產業新聞
每日更新

全球人工智慧產業每日要聞 — 由黃紹麟編選摘要,每天從 100 多則新聞精選 6 則。

79
累積集數
644
則深度解讀
6
大追蹤分類

Dell與NVIDIA聯手推進企業代理AI,Vera Rubin架構推動推論成本下降十倍

2026-06-01 · 來源:NVIDIA AI Blog

在本週舉行的Dell Technologies World大會上,Dell執行長Michael Dell與NVIDIA創辦人暨執行長黃仁勳同台,宣布以Dell AI Factory with NVIDIA為核心的全套企業代理AI(Agentic AI)更新。這是一次從晶片架構、伺服器系統、資料平台到軟體生態的整體推進,而非單一產品發表。

硬體層面,最關鍵的數字是成本與效能的重新定價。搭載NVIDIA Vera Rubin NVL72的Dell PowerEdge XE9812,推論成本較上一代NVIDIA Blackwell架構低至十分之一;搭載HGX Rubin NVL8的三款新伺服器,每機架支援最多144顆GPU,效能達HGX B200的十倍。CPU側,NVIDIA Vera以1.2 TB/s記憶體頻寬,在代理AI工作負載上比x86處理器快50%,Starburst資料引擎在Vera上的SQL查詢吞吐量則達三倍。黃仁勳在台上的定位直白:代理AI讓每個步驟都在等前一步完成,CPU必須足夠快,否則整條流水線都卡住。

規模面,Dell引用其內部調查數據:88%的受訪企業已在本地端跑至少一項AI工作負載,67%的AI工作負載運行在雲端以外。這個數字是Dell與NVIDIA這場聯合押注的市場基礎——企業AI的重心正在從雲端拉回本地,理由是資料主權、模型IP保護與成本控制。本地部署的安全架構依賴NVIDIA Confidential Computing,並整合Fortanix、Google、Red Hat等合作夥伴,讓企業可在不暴露模型權重與敏感資料的前提下部署前沿模型。

生態擴張同樣值得注意。Google Distributed Cloud搭載Gemini 3.0已在Dell PowerEdge XE9780上提供預覽;SpaceXAI將把最新模型引入Dell AI Factory本地部署;OpenAI Codex將與Dell AI Data Platform整合,使代理人能存取企業內部程式碼庫與業務系統。此外,MiniMax-M2.7、DeepSeek Pro、DeepSeek-V4、GLM 5.1、Kimi K2.6均以NVIDIA NVFP4最佳化版本上架Dell Enterprise Hub,這意味著中國模型正以優化封裝的形式進入企業級部署管道,而非停留在研究評測層面。對亞太企業採購者而言,這是一個可落地的訊號。

從產業邏輯看,這場大會的核心論點是:企業AI已過了概念驗證階段,進入必須在本地端安全跑代理工作流程的新階段。Dell提到全球AI基礎設施支出到2030年可能達到3至4兆美元,token消耗量在同期成長3,400%。這些數字的真實性無從獨立核實,但它們所描繪的方向與多個採購端的行為一致。

Dell與NVIDIA的合作模式,本質上是把NVIDIA的運算架構與Dell的企業銷售通路與整合服務綁在一起,用PowerRack這類全整合系統降低企業導入門檻。對競爭對手HPE、SuperMicro或超雲廠商而言,這套組合的壓力在於:它不只賣硬體,而是在賣一個包含安全層、編排層與資料平台的完整棧。Palantir、ServiceNow、CrowdStrike的加入,讓這個棧的黏性進一步提高。

下一個觀察點是6月1日至4日在台北舉行的GTC COMPUTEX,黃仁勳已明示將在那裡延續這些主題的後續發布。代理AI從工作站到資料中心的完整棧,正在從PPT走向可交貨的採購清單。

原文出處
原文標題 15个实测:Kimi K2.6 vs. GLM-5.1 - 汇智网
媒體來源 NVIDIA AI Blog
發布日期 2026-06-01
閱讀原文 ↗

訂閱品富智圖 AI 新聞

每日 AI 產業要聞彙整,一封信直送信箱。