甲骨文與AMD 宣佈 ,將擴大雙方的長期合作伙伴關係,以幫助客户顯着擴展其AI功能和計劃。

基於多年的共同創新,甲骨文雲基礎設施(OCI)將成為首個公開可用的AI超級集羣,由AMD Instinct MI450系列GPU提供支持,從2026年第三季度開始部署5萬塊,並在2027年及以後逐步擴展。藉助新款計算卡,客户將能夠從以下方面獲益:
突破性的計算和內存 - Instinct MI450系列GPU配備了432GB的HBM4,顯存帶寬可達19.6TB/s,每GPU的橫向陣列帶寬可達300GB/s,通過增加AI訓練模型的內存帶寬,幫助客户更快地獲得結果,處理更復雜的工作負載,並減少對模型分區的需求。
優化的“Helios”機架設計 - 集成了UALoE擴展連接和基於UCE橫向擴展網絡,可最大限度地減少延遲,並最大限度地提高跨Pod和機架之間的吞吐量。
強大的節點 - 代號“Venice”的EPYC處理器提供加密計算能力,並內置安全功能,以幫助保護端到端敏感的AI工作負載。
DPU加速的融合網絡 - 基於完全可編程的AMD Pensando DPU技術,為數據中心提供了運行下一個人工智能訓練、推理和雲端工作負載時代所需的安全性和性能。
面向AI的橫向擴展網絡 - 通過面向未來的開放式網絡結構,使客户能夠利用超快速的分佈式訓練和優化的集體通信。每個GPU最多可配備三個800 Gbps AMD Pensando“Vulcano”AI-NIC,為客户提供支持高級RoCE和UEC標準的無損、高速和可編程連接。
創新的UALink和UALoE結構 - 幫助客户有效地擴展工作負載,減少內存瓶頸,並協調大型數萬億參數模型。
開源AMD ROCm軟件堆棧 - 通過為客户提供開放、靈活的編程環境,簡化現有AI和HPC工作負載的遷移。
高級分區和虛擬化 - 實現安全高效的資源使用,使客户能夠根據工作負載需求安全地共享集羣和分配GPU。
AMD表示,Instinct MI450系列是其首款針對人工智能(AI)任務定製的芯片,因此支持相應的數據格式和指令,旨在提供高性能、靈活的雲端部署選項,並提供廣泛的開源支持。