英偉達推出H100 NVL:雙GPU的AI加速器,針對大語言模型訓練設計

英偉達 宣佈 ,針對大型語言模型訓練(LLM)設計,推出全新的H100 NVL計算加速卡。其搭載了兩個基於Hopper架構的H100芯片,頂部配備了三個NVLink連接器,在服務器裏使用了兩個相鄰的PCIe全長插槽。

英偉達去年就推出了H100,擁有800億個晶體管,相比上一代的A100,有着六倍的性能提升以及兩倍的MMA改進。其採用了CoWoS 2.5D晶圓級封裝,單芯片設計,以台積電(TSMC)為英偉達量身定製的4N工藝製造。這次雙GPU版本除了更高的計算性能,更大的顯存容量也是其優勢之一,提供了188GB的HBM3顯存。

H100 NVL計算加速卡的FP64計算性能為134 teraFLOPS,TF32計算性能為1979 teraFLOPS,FP8計算性能為7916 teraFLOPS,INT8計算性能為7916 teraFLOPS,是H100 SXM的兩倍。其具有完整的6144位顯存接口(每個HBM3堆棧為1024位),顯存速率可達5.1Gbps,意味着最大吞吐量為7.8GB/s,是H100 SM3的兩倍多。由於大型語言模型訓練需要更大的緩衝區和更高的帶寬,所以更大的顯存肯定會對運算有所影響。

據瞭解,H100 NVL計算加速卡的功耗略高於H100 PCIe(350W)的兩倍或以上,在700W至800W之間。英偉達計劃在今年下半年推出H100 NVL計算加速卡,不過暫時沒有進一步提供任何的細節。