英偉達創始人兼首席執行官黃仁勳在去年COMPUTEX 2024主題演講中已確認,下一代數據中心GPU架構名為“Rubin”,採用新的HBM4。在今天凌晨的GTC 2025大會上,英偉達更新了數據中心GPU路線圖,還公佈了下下一代數據中心GPU架構的名字,稱為“Feynman”。
據TomsHardware 報道 ,黃仁勳在活動上表示,基於Blackwell架構的B200實際上每個GPU有兩個芯片,這改變了NVLink拓撲,當前提供的解決方案B200 NVL72更應該是“NV144L”才對。接下來基於Rubin架構的解決方案上,英偉達就做了重新的命名和規劃,2026年下半年到來的將是Rubin NVL144,與Blackwell NVL72基礎設施直接兼容。

相比於Blackwell Ultra B300 NVL72,在同一配置數量下(144個GPU芯片),Rubin NVL144提供的FP4計算性能將從1.1 PFLOPS提升至3.6 PFLOPS。雖然每個GPU對應的顯存都是288GB,但是由於升級至HBM4,帶寬將從8TB/s提升至13TB/s。英偉達還會引入更快的NVLink,將總吞吐量提高一倍,達到260TB/s, 機架之前新的ConnectX-9鏈路將達到28.8TB/s。

Rubin產品線另外一個重要更新是升級了CPU,以Vera CPU取代了當前的Grace CPU。Vera將是一個相對小巧緊湊的CPU,擁有88個自定義Arm內核,共176線程,另外還具有一個1.8TB/s NVLink核心到核心接口,用於與Rubin GPU之間的連接。

英偉達在2027年下半年還會推出Rubin Ultra,一方面保留了Vera CPU,另外一方面將對GPU做加強,更換至HBM4E,進一步提高性能表現。同時整個機架將被新佈局NVL576取代,也就是説一個機架規模解決方案內最多可以有576個GPU。這使得FP4推理計算性能飆升至15 ExaFLOPS,另外FP8訓練計算性能為5 ExaFLOPS,計算能力大約是Rubin NVL144的4倍。

進入2028年,英偉達會帶來名為“Feynman”的下下一代數據中心GPU架構,名字取自於著名物理學家Richard Phillips Feynman。