Intel 之前在 Computex 2026 上揭露了一款不走常規路線的資料中心 GPU,產品代號 Crescent Island。這款晶片捨棄了當下 AI 加速器必用的 HBM(高頻寬記憶體),轉而採用 LPDDR5X 作為記憶體方案。 日前 Hot Chips 2026 大會上 Intel 進一步補上架構規格:32 個 Xe 核心、256 個 XMX 引擎,記憶體部分公版配備 160GB,ODM 合作夥伴最高可擴充到 480GB。
為什麼不用 HBM?
Intel 的選擇其實相當務實,當前 HBM 半導體的產能幾乎被 NVIDIA 、TPU 等高階 GPU 產品吃光,早已不是秘密。SK Hynix 掌握約 57% 的 HBM 市場營收,連同 Samsung 在內,兩家供應商的產能已全數分配完畢。SK Hynix 公開表示無法滿足所有客戶訂單,Samsung 記憶體部門主管更警告「顯著缺貨」將延續到 2027 年以後。
對於一張需要數百 GB HBM 的加速卡來說,這種供貨緊張是結構性的產能天花板。Intel 給出的答案是直接跳過 HBM,改用 LPDDR5X,同一套在手機與筆電上量產多年的記憶體標準,由數十家工廠同時量產,供貨無虞。Crescent Island 採用 Intel Xe3P 架構(Xe3 的效能強化版,與 Panther Lake 筆電處理器同源),定位為純推理用的資料中心加速器。
容量 vs 頻寬:一場設計取捨
用 LPDDR5X 代替 HBM,最直接代價是頻寬。Crescent Island 在公版 160GB 配置下約提供 684 GB/s 記憶體頻寬,約是 NVIDIA H200(HBM3e)的七分之一。從數字上看,差距確實很大。但 Intel 的論點是:推理場景的瓶頸不在頻寬,在容量。舉例來說,一個 2000 億參數的模型以 FP8 儲存,約需 200GB 記憶體。在單張 480GB 的 Crescent Island 上,這個模型不需量化、不需跨卡切分就能完整載入。對比之下,NVIDIA H200 僅 141GB HBM3e,B200 約 192GB,裝不下就要切成多卡分散部署,連帶產生跨 GPU 的通訊開銷。
Intel 鎖定的目標是代理型 AI 推理(agentic AI inference),也就是多步驟推理鏈、長上下文文件分析、連續程式碼生成這類工作負載。這些場景不易在跨卡環境中平行化,一張卡能裝下完整模型,部署與管理都簡單得多。Intel 執行長陳立武在 Computex 主題演講中強調,Crescent Island 是專為「代理型 AI」設計的晶片。
記憶體頻寬的實際影響得看配置。公版 160GB 版本的 684 GB/s 頻寬,來自 640-bit 匯流排搭配 LPDDR5X-10667 顆粒。若 ODM 將記憶體擴充到 480GB,匯流排可能需要拉寬到 1280-bit,此時頻寬有機會提升到 1.5 TB/s 左右,縮小與 HBM 加速器的差距。
以小批次推理為例,當每批只送一兩個提示時,運算單元大部分時間在等資料從記憶體送過來,頻寬就是瓶頸。這部分 Crescent Island 和 HBM 加速器的七倍差距會直接反映在輸出速度上。但當推理鏈拉長、上下文累積到數萬 token 時,計算本身的耗時逐漸主導延遲,頻寬的影響就沒那麼顯著了。Intel 的論述建立在後一種場景上:代理型 AI 的推理鏈天然就長,頻寬的邊際效用遞減,容量才是決定能跑什麼模型的關鍵。
350W 氣冷卡,部署門檻更低
Crescent Island 是一張標準 PCIe 附加卡,350W 功耗,不需液冷即可在傳統 4U 或 5U 伺服器機箱內運作。NVIDIA 最新的 Blackwell 系列加速器功耗落在 700W 到 1000W 之間,需搭配客製化液冷基礎設施。對於沒有液冷資料中心的企業來說,Crescent Island 可以直接插進現有機櫃,部署門檻明顯更低。
一張 480GB 容量的卡跑在 350W,代表八卡全滿的系統總功耗約 2,800W,仍落在標準機櫃供電範圍內。從硬體配置來看,Intel 的目標客戶很明確:那些排不上 NVIDIA 供貨名單、又需要大容量推理方案的企業用戶。Intel 的 Arc Pro B70 工作站級推理卡已經證明這條路線可行,Crescent Island 把同一個策略放大到資料中心等級。
八張 Crescent Island 插滿一台 4U 伺服器,總記憶體容量可達 3.84TB(以 480GB 版本計算),足以載入完整的 7000 億參數模型。對照 NVIDIA DGX B200 的 1.4TB HBM3e 總容量,Crescent Island 在記憶體容積上佔了明顯優勢。當然,頻寬差距會讓大批量推理的每卡輸出速度受限,但對於注重模型完整度的場景,容量就是硬道理。
軟體生態與出貨時程
Intel 為 Crescent Island 搭配 oneAPI 軟體堆疊,oneAPI 的普及度遠不如 NVIDIA 的 CUDA 或 AMD 的 ROCm,但對已經在 Intel 生態系內開發的團隊來說,遷移成本相對可控。 Intel 沒有公布任何運算效能數據,沒有 TFLOPS,沒有 TOPS,也沒有推理基準測試。目前整個論述建立在記憶體容量與部署彈性上。
送樣時間訂在 2026 下半年。對照 Computex 六月揭露到八月 Hot Chips 才補上核心規格的節奏來看,Intel 對這款產品的資訊釋放相當審慎。直到有第三方獨立測試數據出來之前,Crescent Island 的實際推理效能仍是個問號。但以單卡 480GB 容量對抗 HBM 供應天花板的策略,至少在市場定位上找到了沒人搶的空間。
從產業角度來看,Crescent Island 更大的意義在於它打破了 AI 加速器「非 HBM 不可」的既定印象。如果 LPDDR5X 路線在推理場景被驗證可行,未來可能會有更多廠商跟進這條路徑,特別是那些被 HBM 供應鏈排除在外的晶片設計公司。Intel 賭的是記憶體容量比頻寬重要,而且賭對的機率隨著模型參數量持續增長而愈來愈高。2026 下半年送樣後,真實世界的測試結果會給出答案。




