日報
AI 產業新聞
每日更新

全球人工智慧產業每日要聞 — 由黃紹麟編選摘要,每天從 100 多則新聞精選 6 則。

71
累積集數
597
則深度解讀
6
大追蹤分類

AMD Advancing AI 2026:EPYC Venice 成首款 TSMC 2nm 量產伺服器 CPU,Helios 機架向 NVIDIA 正面叫陣

2026-07-23 · 來源:Techtimes
幫你做功課
三句話說明發生什麼事
  1. EPYC Venice 是全業界第一款在 TSMC N2(2 奈米)製程進入量產的 x86 伺服器處理器,採用 GAA 奈米片電晶體,旗艦配置達 256 核、單插槽記憶體頻寬 1.6 TB/s。
  2. Helios 機架整合 72 張 MI455X GPU 與 EPYC Venice CPU,整架提供 31 TB HBM4 記憶體,AMD 標稱 FP4 推理算力 2.9 exaFLOPS,功耗約 140 kW;Meta、微軟、甲骨文、OpenAI 已確認採購承諾。
  3. 2026 年 HBM4 產能據報已全數分配給超大規模客戶,MI455X 量產預估到 2027 年 Q2;Intel 的直接競品 Diamond Rapids 最早也要 2027 年中才會出貨。
三句話說明這事的意義
  1. Venice 不只是 AMD 的產品里程碑——作為首款在 N2 滿載運行的 HPC 晶片,它跑出來的散熱、良率、時脈數據,會直接影響 Apple、NVIDIA、高通等公司的 N2 流片計畫,這是一次全行業共用的製程壓力測試。
  2. Helios 的 31 TB HBM4 記憶體優勢聽起來很硬,但 2026 年買不到是真的——真正的競爭窗口在 2027 年,而到那時候 NVIDIA 的下一代也不會坐著等;所以現在的發表更像是爭奪超大規模客戶部署意願的競標,不是面向一般企業的現貨銷售。
  3. ROCm 打推理是可以的,打訓練還差一截;CUDA 生態 18 年的積累不是規格表能填平的,AMD 的勝算在於把成本優勢守住、讓推理場景的客戶先進場,再用時間慢慢把訓練的缺口補起來——但補多快,是這場仗的真正勝負關鍵。

AMD 在舊金山 Moscone West 舉行的 Advancing AI 2026 大會,是近年 x86 伺服器市場最具份量的一次產品集結:EPYC「Venice」、Instinct MI450 系列 GPU 加速器、以及機架規模 AI 系統 Helios 同步亮相。這不只是一場發表會——Venice 是全業界第一款進入量產的 TSMC N2 製程高效能運算晶片,這個事實的意義遠超過 AMD 自身的營收。

Venice 在技術上最重要的不是核心數,是電晶體架構。N2 節點導入 Gate-All-Around(GAA)奈米片電晶體,取代自 2011 年英特爾 22nm 以來主導業界的 FinFET 幾何結構。TSMC 的官方說法是:相同功耗下效能較 N3E 提升 10 至 15%,或相同效能下功耗降低 25 至 30%,電晶體密度突破每平方毫米 3.1 億顆。Venice 在此基礎上把每顆 CCD 塞進 32 個 Zen 6c 核心、旗艦配置達 256 核;記憶體頻寬從 Turin 的 614 GB/s 暴增到 1.6 TB/s,I/O 也升級至 PCIe Gen 6。但買家要注意:新的 SP7 腳座與現行 SP5 完全不相容,這是一次平台整換,不是升級換 CPU。

Helios 機架把 72 張 MI455X 塞進一個雙寬機架,每張卡配備 432 GB HBM4 記憶體、16 堆疊、單卡頻寬 19.6 TB/s;整架累計 31 TB HBM4 記憶體,AMD 標稱 FP4 推理算力 2.9 exaFLOPS、FP8 訓練 1.4 exaFLOPS,功耗約 140 kW——比 NVIDIA Vera Rubin NVL72 的 190 至 230 kW 低一截。記憶體容量是 Helios 最明確的結構性優勢:31 TB 對 Vera Rubin NVL72 的約 20.7 TB,能直接在單架上承載數千億參數模型的權重與推理快取。但算力端 NVIDIA 仍領先:Vera Rubin NVL72 FP4 為 3.6 exaFLOPS,Helios 是 2.9;而且 AMD 的數字尚未提交 MLPerf 獨立驗證,這個空缺在採購決策上不能忽略。

供貨是這場發表裡被低調處理、卻對多數買家最實際的問題。2026 年 HBM4 產能據報已被超大規模客戶包下,MI455X 量產預估要到 2027 年 Q2;Meta、微軟、甲骨文、OpenAI 這四家拿走了近期供給的大部分。甲骨文計畫在 2026 年 Q3 透過公有雲提供 5 萬顆 AMD Instinct MI450 GPU 的超算叢集服務,給中型企業一條間接進場的路。不打算等到 2027 年的買家,Venice 單獨搭配標準 GPU 的伺服器系統時程較早且較廣,是比 Helios 更現實的近期選項。

軟體生態的缺口是採購決策的真正分水嶺。ROCm 7.2.4 已進入 PyTorch 2.7.0 一級後端支援,標準 LLM 推理場景下 AMD GPU 可達同級 NVIDIA H100 約 90 至 95% 的吞吐量,而硬體成本便宜 15 至 30%——對 PyTorch 原生推理管線來說,AMD 在 2026 年確實值得認真評估。但訓練場景的差距擴大到 20 至 30%,TensorRT-LLM 和 FlashAttention 3 都沒有對應的 ROCm 版本,自有 CUDA kernel 的移植成本視複雜度從微小到可觀不等。CUDA 有 18 年的生態積累,一份 2026 年 6 月的分析估計這個優勢在優化生產部署中等同於額外 30 至 99% 的硬體效能。推理換 AMD 有邏輯,訓練重度、客製 kernel 依賴的團隊要先把移植成本算清楚再下手。

Intel 的處境值得單獨一提。現行競品 Clearwater Forest 鎖定高密度橫向擴展場景、對上 Venice 主打的通用及 AI 編排市場不是同一條路;直接競品 Diamond Rapids 確認要到 2027 年中才會出現。企業這季評估伺服器 CPU,實際上是在「現在買 Venice」和「等 12 個月以上等 Intel P 核心競品」之間二選一。AMD 在 2026 年 Q1 拿下 46.2% 的 x86 伺服器 CPU 營收市占,資料中心部門營收 58 億美元、年增 57%——Venice 的任務是把這個溢價定位繼續往前推。至於超越 Intel 的帳面數字能不能守住,要看 ROCm 生態追趕的速度,以及 2027 年 HBM4 產能釋放後 Helios 能不能真的讓更多人買到。

原文出處
原文標題 AMD Advancing AI 2026 Opens With Zen 6 Venice, Helios ...
媒體來源 Techtimes
發布日期 2026-07-22
閱讀原文 ↗

訂閱品富智圖 AI 新聞

每日 AI 產業要聞彙整,一封信直送信箱。