存儲評論網

UALink 聯盟完成 AI 加速器互連 1.0 規範

AI  ◇  企業

UALink聯盟正式批准了其Ultra Accelerator Link 200G1.0規範,為大規模連接AI加速器建立了一套標準化的方法。這項開放標準旨在重塑目前由專有解決方案主導的市場格局。

產業領袖齊心協力推動開放標準

UALink 聯盟成立於 2024 年 85 月,擁有超過 XNUMX 家成員公司,包括科技巨頭 AMD、蘋果、阿里巴巴、AWS、思科、谷歌、HPE、英特爾、Meta、微軟和新思科技。該聯盟成立的目的是創建一個開放的行業標準,用於擴大人工智慧互連解決方案,以滿足現代人工智慧工作負載日益增長的需求。

技術規格和能力

UALink 1.0 技術圖

該規範定義了一種低延遲、高頻寬互連,在單一 AI 計算艙內最多支援 1,024 個加速器。它每條通道傳輸 200 GT/s 的數據,訊號傳輸速度為 212.5 GT/s,以滿足開銷。 UALink 可配置為單通道 (x1)、雙通道 (x2) 或四通道 (x4),其中四通道配置可實現 800 GT/s 的雙向吞吐量。該系統針對 4 公尺以下的電纜長度進行了最佳化,可實現小於 1 微秒的往返延遲。

此架構實現了四個硬體最佳化層:實體層(利用修改後的乙太網路元件)、資料鏈結層(將 64 位元組的 flit 打包成 640 位元組的單元)、事務層(實現壓縮尋址)和協定層(實現加速器之間的直接記憶體操作)。

UALink 1.0 全端

UALink 與現有的專有解決方案相比具有顯著優勢,包括效能最佳化(實現 93% 的有效峰值頻寬和確定性效能)、效率提升(降低功耗、縮小晶片面積、提高頻寬效率)以及透過 UALinkSec 內建的安全功能。它還支援多租戶工作負載的虛擬 Pod 分區。

UALink 1.0 與競爭解決方案

UALink 規範直接挑戰了 NVIDIA 專有的 NVLink 技術,目前已是第五代。 UALink 1.0 支援令人印象深刻的規模,每個 pod 最多可連接 1,024 個加速器,而 NVLink 5 允許在雙層交換架構中連接最多 576 個 GPU。關於原始頻寬,UALink 1.0 在整個系統上提供 819.2 TB/s 的總雙向吞吐量,低於 NVLink 5 的 1036.8 TB/s 的能力。目前規範似乎與先前的 NVLink 4 世代更具競爭力,UALink 仍需要縮小每個 GPU 頻寬和總系統吞吐量的差距,才能與 NVIDIA 的最新產品相符。 

行業影響和未來展望

隨著人工智慧以前所未有的速度發展,對可擴展計算基礎設施的需求日益加劇,特別是對於需要大量測試時間計算資源的推理工作負載,同時新的「推理模型」不斷湧現。擴展互連解決方案必須快速發展,以滿足這些指數級增長的 AI 工作負載需求。 

UALink 標準獲得了包括晶片製造商、雲端提供商和系統整合商在內的 85 多家主要技術公司的支持,具有挑戰專有互連技術的戰略優勢。廣泛的行業支持創造了一個強大的生態系統,可以透過協作創新和競爭性定價超越封閉的解決方案。隨著會員公司積極開發基於該規範的產品,市場很快就會看到各種與 UALink 相容的解決方案,從而支援下一代人工智慧應用。該標準的開放性使其能夠更快地進行迭代和改進,有可能加速其在未來幾代與成熟專有技術的競爭地位。

參與 StorageReview

電子報| YouTube | PodcastiTunes / Spotify | Instagram | Twitter | TikTok | RSS訂閱

迪維揚什·賈恩

機器學習工程師,家庭實驗室愛好者和技術發燒友。在 StorageReview,我負責人工智慧和新興工作負載的測試,提供洞察分析和效能分析。