NVIDIA 宣布全新的擴展 NVIDIA NVLink Fusion 架構,並發表名為 NVHBM 的客製化高頻寬記憶體技術。這項技術將 NVIDIA 自研的記憶體控制器直接整合進 HBM 的基底晶片(base die)中,Amazon 的 Annapurna Labs 將成為首個合作夥伴,在下一代 Trainium4 晶片中採用 NVHBM。與標準 HBM4E 相比,NVIDIA 宣稱 NVHBM 可帶來最高 30% 的記憶體頻寬提升、15% 的 HBM 功耗降低,以及最高 25% 的 XPU 運算晶片面積釋放。
NVHBM 不是新記憶體,是 NVIDIA 要自己定義規格
根據業內人士分析指出,外界容易被「NVHBM」這個名字誤導,以為 NVIDIA 發明了一種新的記憶體。事實上,業界早已存在「標準 HBM」(sHBM)和「客製化 HBM」(cHBM)的區分。cHBM 的研發已進行多年,NVHBM 只是 NVIDIA 版本的 cHBM。
NVHBM 的核心變化是:NVIDIA 自行定義了基底晶片中的控制器和介面規格,然後讓多家記憶體供應商按照同一套規格生產。原本由記憶體廠商與客戶共同設計的客製化架構,現在整塊搬進了 NVIDIA 的平台層。
在傳統的 cHBM 模式下,記憶體廠商與客戶共同設計基底晶片架構,一旦與某家廠商完成設計,要換到另一家就需要重新設計和驗證,這種轉換成本是記憶體廠商保護客製化設計溢價和客戶關係的核心壁壘。NVHBM 打破了這個結構:NVIDIA 定義規格,多家供應商按同一標準供貨,記憶體廠商的差異化空間被壓縮到 DRAM 本身的良率、速度、功耗和製造執行力上。
Counterpoint Research:兆美元瓶頸之爭
市場研究機構 Counterpoint Research 將 NVHBM 的發表定調為「兆美元瓶頸」(The Trillion Bottleneck)的關鍵一步。 他們的分析指出了幾個重要面向:
- NVHBM 從架構變成了平台:從只有一個客戶(NVIDIA 自家 GPU)的架構,擴展為一個有通路的平台。MediaTek 已採用 NVLink Fusion,並將向其自有 XPU 客戶推廣,背後有 NVIDIA 35 億美元(約新台幣 113.7 億元)的投資支撐。
- Broadcom 首當其衝:NVIDIA 現在可以直接銷售晶片架構、機架設計、軟體和記憶體子系統到客製化加速器方案中,不需要自己造加速器。Marvell 已加入 NVLink Fusion,MediaTek 在做轉售,Broadcom 成為唯一沒有與 NVIDIA 掛鉤的大型設計公司。
- 記憶體控制權的轉移:NVIDIA 除了控制 GPU 到 HBM 的介面,還透過多源供貨機制掌握了供應商選擇權。
為什麼 HBM 的基底晶片突然變重要了?
因為 HBM 透過加寬 XPU 與 HBM 之間的介面(從 HBM3E 的 1,024 位元到 HBM4 的 2,048 位元)和提高訊號速率來提升頻寬。但問題在於,更寬的介面需要 XPU 上更多的 PHY 和 I/O 電路,佔用更多的晶片面積和 interposer 路由空間。
在 AI 加速器上,這個代價格外沉重。XPU 的先進製程晶片面積是珍貴資源,應該盡可能用在運算和快取上。HBM 頻寬越高,記憶體介面佔用的面積和功耗比例就越大。HBM4 之後的問題需要一種用更少 XPU 面積和功耗達到相同頻寬的架構。
cHBM 的做法是把部分記憶體相關邏輯從 XPU 搬到先進製程的基底晶片上,重新定義 XPU 到 HBM 的介面。這釋放了原本被 HBM PHY 和控制器佔用的面積,讓回收的矽面積和功耗預算回到運算或快取。Micron 已公開表示,客製化的 HBM4E 基底邏輯晶片將帶來比標準 HBM4E 更高的毛利率。
NVIDIA 的更大野心:定義整個 AI 系統架構
NVHBM 只是 NVIDIA 更大策略的一環,NVIDIA 的目標是將運算、記憶體和互連整合成單一的 AI 工廠架構,HBM 只是其中一環。從 GPU 向外擴展:NVLink 和 NVSwitch 負責 Scale-Up,Spectrum-X 和 InfiniBand 負責 Scale-Out,再加上 BlueField-4 的 Scale-In 和 Context Memory,NVIDIA 已經將 AI 資料中心框定為五大基礎設施支柱。NVLink Fusion 允許客製化 XPU 和 CPU 存在,但記憶體、互連架構和 MGX 機架設計仍然接入 NVIDIA 平台。Amazon Annapurna Labs 的 Trainium4 成為首個 NVHBM 合作夥伴,正是這個策略的具體展現。
MediaTek (聯發科)的角色同樣值得關注。聯發科已採用 NVLink Fusion 架構,並將向其自有 XPU 客戶推廣。NVIDIA 對 MediaTek 投入了 35 億美元(約新台幣 113.7 億元),這筆投資的目的是讓 NVIDIA 的平台觸及更多客製化加速器市場,特別是那些 NVIDIA 直接覆蓋不到的客戶群體。對台灣半導體產業而言,MediaTek 成為 NVLink Fusion 生態系的推廣者,意味著在 AI 基礎設施的架構之爭中,台灣廠商選擇了與 NVIDIA 同陣營的策略。
用 Counterpoint Research 的話說,NVIDIA 現在可以賣晶片架構、機架設計、軟體和記憶體子系統,不需要自己造加速器,就能把整個客製化加速器方案納入自己的生態系。
三星和 SK 海力士怎麼辦?
NVHBM 對記憶體廠商的影響並非全然負面。多源供貨不代表記憶體廠商變成完全可替代的,HBM 在容量、良率、速度、功耗和散熱表現上仍有明顯的供應商差異,供應本身也仍然吃緊。
這些記憶體廠商正在準備下一輪競爭,在 NVHBM 拿走架構設計權之後,仍然存在一個 NVIDIA 無法用規格鎖定的領域,而三星和 SK 海力士正在投入大量人力和資金布局。
結語
NVHBM 的發表揭示了 AI 晶片產業的一個深層趨勢:當運算效能的競爭進入白熱化階段,戰場正在從「誰的晶片更快」轉向「誰能定義整個系統的架構標準」。NVIDIA 不造記憶體,卻要掌握記憶體的設計權;不造客製化加速器,卻要讓所有客製化加速器都接入自己的平台。這是一場關於控制權的遊戲,而 NVIDIA 正在把棋盤越鋪越大。




