事件總覽:從2025年COMPUTEX的Panther Lake處理器內顯Xe3架構亮相,到Hot Chips 2026大會上Intel正式端出針對AI推論場景打造的Crescent Island加速器,這條產品線在一年內從「繪圖思維」切換到「AI思維」,記憶體容量一口氣從24GB暴增20倍到480GB,幾乎是宣告了代理式AI時代對記憶體規格的全新定義。
如果你這幾年有在碰大型語言模型,大概對這種痛不陌生:GPU算力再強,只要記憶體裝不下模型權重,一切都是白搭。Intel在Hot Chips 2026端出來的Crescent Island,與其說是一張繪圖卡,不如說它是一張專為AI推論設計的記憶體載具,只是剛好長得像PCIe擴充卡。
📅 2025年5月:Xe3內顯架構首度公開,埋下Crescent Island的伏筆
其實在COMPUTEX 2025期間,Intel發表Panther Lake處理器時就揭露了Xe3架構的基本輪廓,當時媒體多半聚焦在12組Xe核心帶來50%的效能成長,但很少人注意到一個細節:Xe3的「繪圖切片」內含4組Xe核心加4組光線追蹤單元,這跟後來Crescent Island的「運算切片」組成8組Xe核心、完全捨棄光線追蹤單元的方向完全不同。換句話說,Intel從一開始就把Xe3拆成兩條路線在走,一條給遊戲,一條給AI,只是當時後者還沒浮上檯面。
📅 2026年8月:Hot Chips 2026正式發表,Crescent Island規格全揭露
到了今年的Hot Chips,Crescent Island就沒在客氣了。它採用的Xe3P架構以Xe3為基礎,但把矩陣運算的Systolic層數從4層拉高到16層,額外支援FP4、FP8與Full Rate FP64,等於是把低精度推論和高精度科學計算兩條路同時打通。每組Xe核心內含8組XVE向量引擎與8組XMX矩陣引擎,配上專屬512KB L1快取,整個GPU由4組運算切片構成,總共32個Xe核心、256組矩陣引擎,L2快取容量高達32MB。
但說真的,這些算力數字雖然漂亮,真正讓市場眼睛一亮的,絕對是記憶體。
📅 2026年下半年:480GB LPDDR5X,容量比前一代多20倍
Crescent Island搭載最高480GB的LPDDR5X記憶體,跟前一代Arc Pro B60運算卡的24GB GDDR6相比,直接差了20倍。這不是小改款,這是完全不同的物種。Intel在會場上講得很直白:代理式AI工作負載對延遲的要求更嚴苛,前後文窗口愈來愈大,記憶體容量需求只會往上衝。講白一點,你如果要在單卡上跑Llama 3等級的模型,或者同時服務多個使用者的長上下文查詢,記憶體就是最現實的瓶頸。
改用LPDDR5X還有另一層好處:功耗。整張卡TDP控制在350W,採用氣冷散熱,這在資料中心代表什麼?代表你不用為了這張卡重新拉水冷管路,也不用擔心機櫃配電要重算。對於還在用PCIe插槽擴充既有伺服器的IT團隊來說,這是實際到不行的成本節省。
軟體相容性才是真正的護城河
硬體規格再漂亮,如果開發者要重寫整個軟體堆疊,那一切都是白搭。Intel這次很聰明地強調Crescent Island仍然基於Xe架構,與先前Arc Pro系列運算卡在軟體面上完全相容。換句話說,你現在用oneAPI寫的AI應用,上市首日就能直接部署上去,不用等驅動程式修bug、也不用重新學習新的程式模型。
這點在AI推論的場域特別關鍵。推論不像訓練可以慢慢調參數,推論是直接面對使用者的,延遲太高就是掉客訴。Intel提供的開放式AI軟體堆疊,加上對異質運算平台的支援,等於是幫企業客戶省掉最頭痛的「移植地獄」階段。從Token-as-a-Service供應商的角度來看,能越快把模型跑起來、每顆Token的成本越低,競爭優勢就越明顯。
編輯觀點:Crescent Island的出現,其實反映了AI硬體市場一個很關鍵的轉折——記憶體容量已經比算力更早成為推論場景的決勝點。NVIDIA這幾年忙著堆AI算力,但H100的80GB HBM在面對真正大規模的代理式AI部署時,反而讓客戶得靠NVLink串接多卡來解決記憶體瓶頸,成本一下子就噴上去。Intel這次用PCIe卡搭配480GB LPDDR5X,等於是用更親民的部署彈性,去打NVIDIA相對昂貴的垂直整合方案。當然,Crescent Island的實際推論吞吐量還要等樣品出來才知道,但至少它在「容量/成本/部署便利性」這三個維度上,確實走出了一條跟NVIDIA不一樣的路。對一般企業來說,這可能是未來一年最值得關注的AI推論硬體選項之一。
誰該認真看待這張卡?
如果你經營的是AI即服務平台、或是企業內部要部署大型語言模型的推論節點,Crescent Island的規格值得你現在就開始關注。480GB的單卡記憶體容量,意味著你可以把以前需要4到8張卡才能載入的模型,縮減到1到2張卡就能搞定,不但機櫃空間省下來,電力成本也會顯著下降。
話說回來,350W的TDP配上氣冷方案,對機房基礎設施來說門檻低很多。你不用為了導入新硬體而大興土木,這在總持有成本的計算上會是一個很大的加分項。
比較實際的觀察點會落在2026年下半年樣品開始出貨之後。到時候獨立評測機構的數據會告訴我們,Xe3P的矩陣運算效率在真實的推論場景中到底能跑出什麼水準,以及Intel的軟體堆疊在對應主流框架(PyTorch、TensorFlow等)時的成熟度如何。如果你現在正在評估下一代的推論硬體採購,我建議你把Crescent Island列入候選名單,但先等樣品效能數據出來再做決定。
畢竟AI硬體這幾年進步太快,紙上發表跟實際落地的差距,往往比想像中來得大。
本文改寫整理自公開新聞來源,原始報導由T客邦發布。
常見問題 FAQ
Crescent Island的480GB記憶體對AI推論實際幫助有多大?
幫助非常直接。480GB LPDDR5X讓單卡可以載入原本需要多卡串聯的大型模型,大幅降低跨卡通訊延遲,尤其適合前後文窗口大的代理式AI應用,能顯著提升Token吞吐量。
Crescent Island跟NVIDIA的AI推論卡相比有什麼優勢?
最大的差異在於部署彈性與成本結構。Crescent Island採用標準PCIe介面與氣冷散熱,能直接裝進現有伺服器,不必更換機櫃或水冷系統,總持有成本更具競爭力,記憶體容量也遠超多數同級產品。
Xe3P架構跟一般的Xe3有什麼不同?
Xe3P是專為AI運算強化的版本,矩陣運算的Systolic層數從4層提高到16層,額外支援FP4、FP8與Full Rate FP64,同時每組運算切片配備8組Xe核心,與Xe3繪圖切片的4組核心配置完全不同,兩者的設計目標從根本上就不一樣。
什麼時候可以買到Crescent Island?
Intel預計在2026年下半年向客戶提供樣品,實際量產出貨時間會落在樣品驗證之後,建議密切關注Intel官方公告。
既有的Arc Pro系列軟體能直接移轉到Crescent Island嗎?
可以。Crescent Island基於相同的Xe架構基礎,支援oneAPI與完整的AI軟體堆疊,上市首日就能將現有應用程式無縫部署,不需要重新開發或大幅修改。
※ 此篇文章由 AI 改寫或生成,內容僅供參考,可能存在錯誤或不準確之處。