NVIDIA 與微軟今日共同宣布,首波 Vera Rubin 平台已正式開始裝機。NVIDIA 官方 X 帳號發文表示:「Vera Rubin 正加速進入全面量產,恭喜微軟團隊促成這個令人振奮的里程碑。」過去幾個月來,NVIDIA 從 GTC Taipei 宣布全面量產到實際出貨給客戶,節奏比外界預期更快。這代表次世代旗艦 AI 運算平台從量產階段正式邁入實際部署,微軟也因此成為全球第一家在大規模資料中心部署 Vera Rubin 的雲端業者,為後續 AWS、Google Cloud 等競爭對手的跟進建立了實際案例。
NVIDIA Vera Rubin is ramping into full production. Congrats to the teams at @Microsoft who made this exciting milestone happen. https://t.co/kXX1JPTeVe
— NVIDIA (@nvidia) August 21, 2026
Vera Rubin 平台:七款晶片、五座機櫃組成 AI 超級電腦
Vera Rubin 是 NVIDIA 至今規模最大的 POD 級系統。從 Blackwell 到 Vera Rubin,NVIDIA 僅花了 18 個月,大幅壓縮了業界常見的 24 到 30 個月開發週期。整個平台由五座專用機櫃組成,涵蓋 Rubin GPU、Vera CPU、NVLink 6 Switch、ConnectX-9 SuperNIC、BlueField-4 DPU、Spectrum-6 乙太網路交換器與 Groq 3 LPU 共七款專用晶片。NVIDIA 稱這套架構為「極端協同設計」(extreme co-design),將整個機櫃系統視為一個分散式加速器來運作,而非各自獨立晶片的組合。
旗艦型號 Vera Rubin NVL72 機櫃搭載 72 顆 Rubin GPU 與 36 顆 Vera CPU,透過 NVLink 6 高速互連。每顆 Rubin GPU 配備 288 GB 的 HBM4 記憶體,頻寬高達 22 TB/s,相較 Blackwell Ultra B300 的 8 TB/s 記憶體頻寬提升了近三倍。NVIDIA 宣稱 Rubin 推理效能可比 Blackwell 提升 5 倍,訓練效能提升 3.5 倍,每 Token 推理成本降低 10 倍。整個 NVL72 機櫃採用 100% 液冷散熱,搭配無纜線模組化托盤設計,安裝時間從 Blackwell 的兩小時大幅縮短至五分鐘。NVIDIA 表示,這些設計使得 AI 工廠的部署速度與密度都達到前所未有的水準。
微軟搶先部署,Fairwater AI 超級工廠即將啟用
微軟這次是 Vera Rubin 第一家超大規模部署客戶。微軟將把 Vera Rubin NVL72 機櫃系統部署於次世代 AI 資料中心,包含尚未公開的 Fairwater AI 超級工廠站點。這些系統將為 Azure 雲端 AI 服務提供底層算力基礎,支援 OpenAI 的模型訓練與大規模推理工作負載。NVIDIA 加速運算副總裁 Ian Buck 日前在總部向媒體證實,系統已開始出貨給客戶,OpenAI、CoreWeave、Google Cloud、Microsoft Azure、Meta 與 Dell 均在首批名單中。CoreWeave 向 Bloomberg 表示其 NVL72 機櫃的 Token 輸出量已達到上一代的 10 倍,驗證了 NVIDIA 提出的 10 倍 Token 成本降幅已從規格變成實際可達標的。
除了微軟與 CoreWeave,已確認的首波雲端部署合作夥伴還包含 AWS、Google Cloud、Oracle Cloud Infrastructure,以及 Lambda、Nebius 和 Nscale 等 NVIDIA 雲端合作夥伴。NVIDIA 也確認戴爾科技、HPE、聯想、美超微等系統大廠,以及華碩、鴻海、技嘉、和碩、雲達、緯創、緯穎等台灣供應鏈夥伴均已採用 NVIDIA DSX 平台來加速 Vera Rubin 的量產。Vera Rubin 同時整合 BlueField-4 DPU,支援高達 800Gb/s 的軟體定義網路與硬體級多租戶隔離,並透過全端機密運算技術提供機架級的可信任執行環境,確保多租戶雲端環境中的資料與模型安全。NVIDIA 也強調,DOCA 軟體平台可以在 AI 工廠的每個機櫃與每一層提供進階安全防護,透過直接在 BlueField-4 晶片中強制執行的功能來保護資料與推理過程,且所有加密與威脅偵測都不會佔用主機 CPU 資源,讓安全防護不影響運算效能的同時還能做到多租戶隔離與零信任策略強制執行。
量產規模與供應鏈動員
NVIDIA 於今年 5 月 31 日在 GTC Taipei 正式宣布 Vera Rubin 全面進入量產。供應鏈規模是 Grace Blackwell 的兩倍,涵蓋全球 30 個國家、350 座工廠,僅台灣就有超過 150 家合作夥伴參與,從鴻海到緯穎等一線 ODM 廠全部投入生產線。NVIDIA 執行長黃仁勳在 GTC Taipei 時表示:「代理型 AI 是一種全新的工作負載,一個提示即可啟動包含推理、資訊檢索、工具調用以及回應生成等長達數千步驟的運算流程。Vera Rubin 正是為此而生。」他也強調 AI 已從成本項目轉變為真正的獲利引擎與 GDP 生成器。
據供應鏈消息,Vera Rubin 的量產出貨預計於今年秋季正式展開,2026 年 Q4 出貨量將攀升至 25 到 30 萬顆 GPU(約 3,500 台整機),2027 年 Q1 進入全行業大規模交付。NVIDIA 同時導入已量產的 Spectrum-X 乙太網路光子技術,結合共同封裝光學(CPO)技術,實現百萬 GPU 規模的 AI 工廠網路架構。這項技術使用 200Gb/s SerDes 的交換器,能源效率比傳統可插拔收發器提升 5 倍,AI 正常運作時間延長 5 倍,部署速度提升 1.3 倍。根據 NVIDIA 官方數據,Vera Rubin 在大規模部署下的代理資料輸送量比 Grace Blackwell 平台高出 10 倍,且系統已通過開源 MGX 架構設計的驗證,確保供應鏈中的數百家合作夥伴可以快速跟進量產。CoreWeave、Lambda 和 Oracle Cloud Infrastructure 是第一波採用 CPO 網路的雲端業者,其中 CoreWeave 已公開表示其 Rubin 機櫃的 Token 輸出量確實達到上一代的 10 倍,而非僅停留在 NVIDIA 的公版宣稱數字。
結語
NVIDIA 這次直接在官方推文中點名微軟團隊慶祝裝機,凸顯雙方的戰略夥伴關係。微軟需要最新的 Rubin 硬體來維持 Azure AI 在模型訓練與推理服務上的競爭力,NVIDIA 則需要微軟這種等級的首發客戶來驗證 Vera Rubin 的量產成熟度與大規模部署能力。隨著 AWS、Google Cloud 與 CoreWeave 等業者隨後跟進,2026 下半年到 2027 年將是 AI 運算基礎設施從 Blackwell 世代全面轉移到 Rubin 世代的關鍵時期。半導體產業協會(SIA)數據顯示,2026 年 5 月全球半導體銷售額已達 1,206 億美元,年增 104%,這個數字背後的驅動力很大一部分來自超大規模資料中心對 AI 運算晶片的旺盛需求。Vera Rubin 的量產與部署將進一步推動這波產業循環。




