選單 首頁 搜尋
東森財經新聞台 Apps
於 免費下載
下載
首頁財經新聞 > 焦點 > 曾經以為「被消失」! 郭明錤爆料 黃仁勳秘密武器重出江湖

曾經以為「被消失」! 郭明錤爆料 黃仁勳秘密武器重出江湖

東森財經新聞
曾經以為「被消失」! 郭明錤爆料 黃仁勳秘密武器重出江湖

市場原以為Nvidia已放棄Rubin CPX,但天風國際證券分析師郭明錤最新產業調查指出,Nvidia已重啟Rubin CPX,預計2027年第1季開始生產。新版CPX改用168GB HBM4、獨立機櫃設計,並鎖定AI推論中的prefill工作,瞄準長上下文應用需求。

Nvidia重啟Rubin CPX

相較舊版設計,新版Rubin CPX不僅提升預填充效能,GPU規格與機櫃架構也同步調整,顯示Nvidia正更加重視AI推論階段的prefill需求。郭明錤指出,新版CPX單顆GPU算力接近Rubin,最高功耗同樣達2300W;記憶體則改用168GB HBM4。雖然容量低於Rubin的288GB HBM4,但相較舊版CPX採用的128GB GDDR7已有提升,並可提供更高的記憶體頻寬,以支援長上下文推論所需的資料處理。

★【理財達人秀】欣興出事 暴雷暴富? 熱錢大洗牌 看高搶起漲 ★

改採獨立MGX機櫃

郭明錤表示,新版CPX採用獨立的MGX ETL機櫃,不再像舊版與Rubin共用機櫃。客戶可依需求配置64、128、192或256顆CPX。其中,每64顆CPX構成一個機櫃模組,由8個運算托盤與1個交換機托盤組成,每個運算托盤配置8顆CPX。這種設計讓CPX可以依照AI推論需求彈性擴充,而非被綁定在Rubin系統內。

雙向架構與分工模式

在系統運作上,CPX並非取代Rubin,而是與Vera Rubin NVL72搭配使用。Nvidia建議CPX與Rubin的配置比例為1:1。其中,CPX主要負責prefill,也就是先處理使用者輸入的大量context內容並建立KV cache;完成後,再透過Ethernet RDMA將資料傳給Rubin,由Rubin負責後續的decode生成。簡單來說,CPX負責「讀懂大量輸入」,Rubin則負責「生成答案」,兩者形成分工。新版CPX的互連架構也有所不同。NVLink主要用於同一運算托盤內8顆CPX GPU之間的scale-up,每顆CPX的NVLink頻寬約1至1.5TB/s,低於Rubin的3.6TB/s。至於同一機櫃模組內不同托盤之間,則改透過Spectrum-6 Ethernet進行scale-out;跨機櫃模組時,再透過Spectrum-6搭配OSFP光纖進行連接。這也代表新版CPX更加依賴Nvidia的Ethernet網路架構,而不是單純依靠GPU之間的高速互連。

長上下文推論的高性價比利器

郭明錤認為,新版CPX的核心定位,是成為「長上下文prefill的最高性價比方案」。目前AI推論工作量中,超過一半來自處理輸入context並建立相應KV cache,因此Nvidia希望透過CPX,以更彈性的部署方式及較低成本承擔prefill工作。每個運算托盤配置8顆CPX,合計約1.34TB HBM4,可支援大多數長上下文prefill與KV cache建立需求。換言之,Nvidia重啟CPX並非單純增加另一款GPU,而是針對AI推論架構進行重新分工。隨著大型語言模型context window持續拉長,prefill所占的運算需求增加,CPX的重要性也可能進一步提升。

(封面圖/翻攝自輝達官網)

 

【往下看更多】
看好輝達會大漲!《大賣空》貝瑞加碼放空 同時買入看漲期權
不敢單押輝達? 陳重銘點名「高含輝量ETF」:只要10元
營收分成引疑慮?傳輝達暫停「部分AI雲端融資計畫」

 

【熱門排行榜】
PTFE無布版好香但很軟? 專家揭良率疑慮下的「修復黑馬」
矽光子要起飛了? 台積電曝明年市占逾50% CPO下半年拚量產
外資賣超143億 逆勢「買這檔」網驚呆:撿便宜?
關鍵字: 郭明錤黃仁勳NvidiaRubin CPX秘密武器
FB分享
字體變大
字體變小
加入Facebook粉絲團
訂閱Youtube頻道
收合