知名分析師郭明錤最新發文表示,輝達已重啟先前市場傳聞已從路線圖剔除的Rubin CPX項目,預計明年第一季投產。
相較於先前設計,新版CPX大幅強化預填充(prefill)效能,並對GPU規格與機架架構作出重大改動,凸顯輝達對預填解決方案的高度重視。
規格方面,CPX改用168GB HBM4(原設計為128GB GDDR7,Rubin為288GB),功耗上限符合Rubin的每顆2300 瓦。機架改採獨立MGX ETL設計,客戶可選64/128/192/256顆GPU配置,每64顆構成一個機架模組,由八個運算托盤(各含8顆CPX)與一個交換托盤組成。
互聯架構上,NVLink(每秒頻寬1–1.5TB)僅用於托盤內縱向擴展,跨托盤橫向擴展由Spectrum-6乙太網路全銅L1鏈路承擔,跨模組則經OSFP光鏈路處理。
運作模式上,CPX必須與Vera Rubin NVL72搭配,建議 1:1配置,CPX還負責預先填充並建構KV緩存,再透過乙太網路RDMA傳輸給Rubin進行解碼。
郭明錤強調,當前逾50%AI推理工作負載來自輸入上下文處理及KV快取構建,每個八顆CPX托盤擁有約1.34TB HBM4,足以涵蓋多數長上下文預填充需求。
他並指出,CPX 的定位正是長上下文場景下單位成本的最佳效能解方,為AI推理基建提供靈活且低成本的預填選項。
