前段時間Intel公佈了Habana Gaudi 2加速器的MLPerf測試結果,表明了它在先進的視覺語言模型上擁有卓越的性能,現在三個月過去了,Intel再次公佈了這測試的最新結果,獲得的數據證明Gaudi AI加速器可以成為NVIDIA H100 GPU的可行代替品,顯示了Intel在AI推理方面極具競爭力。

根據Intel公佈的數據,Gaudi 2加速器的性能有不錯的提升,超過了對手NVIDIA的A100 GPU,Intel表示與市場上同類產品相比,他們的Gaudi 2加速器有更佳的價格,考慮到NVIDIA A100的售價,他們的説法確實沒錯。

Gaudi 2在GPT-J模型上的推理結果強有力地驗證了其具有競爭力的性能,與NVIDIA的H100相比,Gaudi 2的表現還是可以的,H100相對於Gaudi 2只有1.09倍服務器以及1.28倍離線性能優勢。而Gaudi 2對比A100,服務器性能要高出2.4倍,離線性能則高出2倍,Gaudi 2提交的結果採用FP8數據類型,並在這種新數據類型上達到了99.9%的準確率。
隨着每6-8周公布的Gaudi 2軟件更新,Intel將繼續在MLPerf基準測試中展現其產品的性能提升,以及持續擴大的模型覆蓋範圍。
除此之外,Intel還公佈了第四代至強可擴展處理器以及至強CPU Max的一些測試結果,其中包括GPT-J模型。結果顯示,包括視覺、語言處理、語音和音頻翻譯模型,以及更大的DLRM v2深度學習推薦模型及ChatGPT-J模型在內,第四代至強處理器對於通用AI工作負載擁有出色的性能。

第四代至強可擴展處理器是通過流行的AI框架與庫構建及部署通用AI工作負載的理想選擇。對於GPT-J對約1000-1500字新聞稿進行100字總結的任務,第四代至強可擴展處理器可在離線模式下完成每秒兩段的總結提要,在實時服務器模式下完成每秒一段的總結提要。
Intel首次提交了英特爾至強CPU Max系列的MLPerf結果,該系列可提供高達64GB的高帶寬內存。對於GPT-J而言,它是僅有的能夠達到99.9%準確度的CPU,這對於對精度要求極高的應用來説至關重要。
Intel與OEM廠商合作提交了測試結果,進一步展示了其AI性能的可擴展性,以及基於至強處理器的通用服務器的可獲取性,充分滿足客户服務水平協議 (SLA)。
Intel執行副總裁兼數據中心與人工智能事業部總經理Sandra Rivera表示:“正如最新的MLCommons結果顯示,我們擁有強大的、具有競爭力的人工智能產品組合以滿足客户對高性能、高效率的深度學習推理及訓練的需求,同時,針對各種規模的人工智能模型,英特爾產品組合均具有領先的性價比優勢。”