NVIDIA正式發佈GA100 GPU核心並推出DGX A100:計算性能上的一次飛躍

今晚9點,NVIDIA正式上線了GTC 2020的主題演講視頻,視頻被分為8個部分,其中的第二部分主題是NVIDIA的RTX技術,而在第六部分,CEO黃仁勛正式發佈了基於新一代Ampere的A100加速計算卡和基於A100加速卡的新一代DGX A100 AI計算系統。

我們首先來看人們最為關心的新一代Ampere架構,完整版的GA100核心架構圖如下:

可以看到完整版的GA100擁有128組SM,每組SM中擁有4個最新第三代Tensor Cores,仍然是64個CUDA Cores/SM的結構。所以完整的GA100擁有8192個CUDA核心和512個第三代Tensor Cores,因為它是面向純計算領域的核心,所以沒有RT Core,可以説是Volta架構的直屬繼承者,面積高達826mm 2 ,比GV100核心還要大,這還是換用了台積電的7nm工藝才達成的。

而此次發佈的A100計算卡上面使用的GA100核心並不完整,被屏蔽了20組SM,所以它的規模是108組SM,6912個CUDA核心外加432個Tensor Cores,可以提供約19.5 TFLOPS單精度計算能力和9.7 TFLOPS的雙精度計算能力。

Tensor Cores在Ampere架構上面進化到了最新的第三代,NVIDIA特別引入了全新的Tensor Float(TF32)數據格式,可以讓Tensor Cores在沒有改動代碼的情況下提高20倍的單精度性能,另外,新的Tensor Cores加入了針對雙精度浮點的支持,可以在諸多場景中發揮出更大的作用。

GA100上面還引入了新的多實例GPU功能,該功能支持將單GPU的計算資源切分成最多7塊,多任務也好,虛擬化也好,這個特性對數據中心是相當友好的。

另外,用於GPU之間互聯的NVLink技術升級到了第三代,能夠提供最高600GB/s的數據傳輸速度,同時GPU的PCIe支持升級到了4.0版本,最高數據傳輸速度提升到了64GB/s。A100計算卡使用了40GB的HBM2顯存,能夠提供高達1.6TB/s的恐怖顯存帶寬。

image-20200514215603222

憑藉着架構和製程的升級,A100計算卡的性能較上一代——V100出現了飛躍,各種官方數據中,它相比V100都是成幾倍的碾壓。

基於這張計算卡構建的DGX A100系統,也就是黃仁勛此前給我們從烤箱裏面拿出來的那張“卡”,則是擁有恐怖的5PFLOPS的計算能力(半精度),不過它的售價也及其高昂,單節點的價格高達20萬美金。

好了,看完這個逆天級別的A100,我們説回第二部分中的重點——NVIDIA RTX技術。NVIDIA此次着重提到了《Minecraft》在加入RTX特效之後,諸多主播們的反應,並且宣佈繼續為這款遊戲帶去新的5張帶有RTX效果的地圖,這幾張地圖都是由知名的《Minecraft》玩家或團隊傾力打造的,擁有豐富的可玩性和很好的展示效果。

當然,GTC 2020主題演講內容不止於此,黃仁勛還展示了他們在自動駕駛、醫療保健、科學計算和HPC等領域中的成就和最新發布,我們會對這些內容做簡要的介紹。