CoreWeave 已在新的 Dell XE200 伺服器上部署了最新的 GB72 NVL-9712 系統。該系統在 Switch 最先進的數據中心進行了現場演示,強調了其突破性的性能和先進的冷卻基礎設施。
CoreWeave 的 GB200 NVL-72 系統位於 Rob Roy 的 Evo Chamber 中,旨在處理最苛刻的計算工作負載。現場演示從 NCCL All-Reduce 測試開始,該基準測試展示了機架 72 個 GPU 上 Nvidia NVLink 互連的超高頻寬和低延遲。此測試確保 GPU 之間的無縫通訊。

使用 CoreWeave 的 Sunk 進行現場訓練
GB200 NVL-72 也使用 Kubernetes (Sunk) 上的 Slurm 進行了即時訓練測試,訓練威震天模型。培訓課程透過實際工作負載驗證了機架,並演示了冷卻和電力基礎設施上產生的負載。


羅布·羅伊的進化室
NVL72 安裝在 Rob Roy 的 Evo Chamber 中,每個機架提供令人印象深刻的 1MW 電力和冷卻能力。這項基礎設施的進步將 250kW 的空氣冷卻與 750kW 的直接晶片液體冷卻能力相結合,確保為最苛刻的 AI 和 HPC 工作負載提供最佳性能。該室的複雜設計可保持高效的電源使用和熱管理,同時支援下一代運算要求。
結語
在證明人工智慧基礎設施即服務方面,CoreWeave 無疑是產業領導者。他們的成功很大程度上歸功於他們比其他雲端更快搭載最新人工智慧基礎設施的能力。全新戴爾 GB200 NVL-72 系統代表了高效能運算的新時代。它們結合了尖端的GPU 性能、先進的冷卻解決方案和能源效率,以滿足人工智慧、科學研究和數據密集型應用程式的需求,這對於大規模運行人工智慧工作負載的客戶來說是巨大的勝利。





Amazon