Intel

UALink 1.0規範發佈:支持連接1024個加速器,每通道200GT/s帶寬

去年AMD、博通(Broadcom)、思科(Cisco)、谷歌(Google)、Hewlett Packard Enterprise (HPE)、英特爾(Intel)、Meta和微軟(Microsoft) 宣佈 成立Ultra Accelerator Link (UALink)聯盟,共同制定一項新的行業標準,致力於推進數據中心中擴展AI系統的高速和低延遲通信。隨後蘋果、阿里雲、以及Synopsys 加入 ,被選為UALink聯盟董事會新成員。

UALink聯盟 宣佈 ,正式發佈UALink 1.0規範,意味着小組成員現在可以對支持新技術的芯片進行流片。其允許在一個計算集羣(Pod)內,讓接入的GPU等加速器附帶的內存之間實現直接加載和存儲,提升共同完成大規模計算任務的效率。

UALink協議棧包括四個硬件優化層,分別是物理層、數據鏈路層、事務層和協議層。其中物理層使用標準以太網組件(例如200GBASE-KR1/CR1),幷包括使用FEC減少延遲的修改;數據鏈路層將事務層的64字節的數據打包成640字節的單位,應用CRC和可選的重試邏輯,另外還負責處理設備間的消息傳遞;事務層實現壓縮尋址,在實際工作負載下以高達95%的協議效率簡化數據傳輸。針對現代數據中心使用,還集成了安全和管理功能,計算集羣將通過專用控制軟件和固件代理,使用PCIe和以太網等標準接口進行管理。

UALink 1.0規範支持每通道200 GT/s的雙向數據速率,信號速率為212.5 GT/s,以適應前向糾錯和編碼開銷。UALink可以配置為x1、x2或x4通道,其中四通道鏈路在發送和接收方向的速度最高可達800 GT/s。

單個UALink 1.0系統支持連接多達1024個AI加速器,通過UALink交換機連接,每個AI加速器分配一個端口和一個10-bit唯一標識符,以實現精確路由。UALink 電纜長度經過優化,長度小於4米,在64B/640B有效載荷下實現小於1µs的往返延遲。此外,這些鏈路支持跨一到四個機架的確定性性能。

在外界看來,UALink聯盟的創立就是為了改變英偉達在人工智能芯片領域一家獨大的格局,競爭目標是稱為“NVLink”的互連通信協議。UALink 1.0規範允許在連接到處理器的內存之間直接傳輸數據,這對於AI訓練工作負載尤其重要。