存儲評論網

Lenovo SR675 V3 和 NVIDIA L40S GPU 幫助驅動下一代人工智能係統

AI  ◇  企業

由 NVIDIA 全新 L675S GPU 提供支持的 Lenovo ThinkSystem SR3 V40 服務器登上了洛杉磯 SIGGRAPH 的舞台,成為 NVIDIA 計劃推進全球 AI 推廣並引入智能聊天機器人、搜索和摘要工具等生成式 AI 應用程序的焦點。各行業的用戶。

新的 ThinkSystem 作為 NVIDIA OVX 服務器進行展示,並將很快集成最近發布的 NVIDIA L40S GPU。 此次合作預計將有助於徹底改變人工智能的實施,實現下一代人工智能、沉浸式元宇宙模擬和大規模的認知決策。

NVIDIA L40S GPU

新推出的NVIDIA L40S GPU 是一款功能強大的通用數據中心處理器,專為加速計算密集型應用而設計,包括人工智能訓練和推理、3D 設計和可視化、視頻處理以及使用NVIDIA Omniverse 平台的工業數字化。 它擁有針對大型語言模型 (LLM) 推理和再訓練、圖形和視頻應用程序的突破性多工作負載加速。

L40S GPU 為下一代支持 AI 的音頻、語音、2D、視頻和 3D 應用程序提供支持,是即將推出的 NVIDIA Omniverse OVX 3.0 平台的關鍵組件,可提供高保真度和準確的數字孿生。

NVIDIA L40S GPU

NVIDIA L40S GPU 將成為 NVIDIA OVX 系統的關鍵資產。 每台服務器均採用 NVIDIA Ada Lovelace GPU 架構和 48GB 內存,最多可容納 40 個 L8S GPU。 它還擁有第四代 Tensor Core 和 FP1.45 Transformer Engine,提供驚人的 XNUMX petaflops 張量處理能力。

與前身 NVIDIA A100 Tensor Core GPU 相比,L40S 的生成式 AI 推理性能提高了 1.2 倍,訓練性能提高了 1.7 倍,可處理具有數十億個參數和多種數據模式的複雜 AI 工作負載。

L40S GPU 旨在滿足各種專業工作流程。 它包含 142 個第三代 RT 核心,可提供 212 teraflops 的光線追踪性能,非常適合實時渲染、產品設計和 3D 內容創建等高保真專業可視化工作流程。

此外,L40S 的 18,176 個 CUDA 內核提供的單精度浮點 (FP5) 性能是 NVIDIA A32 GPU 的近 100 倍,確保以更高的效率滿足工程和科學模擬的計算需求。

ThinkSystem SR675 V3 配置

聯想的戰略定位是通過針對新 GPU 進行優化的新服務器系列來支持 L40S。 通過將完全模擬的數字孿生與生成式人工智能相結合,聯想旨在改進其業務流程和設計成果。 聯想與 NVIDIA 在 NVIDIA OVX 系統上的合作促進了虛擬世界的構建和運營,將系統的功能擴展到生成式 AI,並為具有 AI 工作負載的數據中心提供強大的性能。

ThinkSystem SR675 V3 提供三種服務器配置合二為一,其中包括對具有 NVLink 和 Lenovo Neptune 混合液體冷卻功能的 NVIDIA HGX A100 4-GPU 系統的支持。 此外,它還兼容 4 或 8 個 GPU 配置,這些配置在 40U 空間內配備 NVIDIA L100S、NVIDIA H80 100GB 或 NVIDIA H3 NVL 服務器。

聯想認為這些發展是簡化人工智能部署的重大飛躍,使各種規模的組織都可以使用它,並推動所有行業的變革性智能。

ThinkSystem SR675 V3 配置:基礎模塊、密集模塊和 HGX 模塊

在 AI/HPC 服務器配置領域,了解不同配置的權衡和優勢對於優化和特定工作負載要求至關重要。 Lenovo ThinkSystem SR675 V3 的 Base、Dense 和 HGX 模塊配置具有靈活性,每種模塊配置均針對特定需求而設計。

基本模塊

基本模塊配置可滿足尋求 GPU 支持和存儲功能平衡組合的組織的需求。 最多可容納4個雙寬、全高、全長; FHFL GPU,利用 PCIe Gen5 x16 連接。 這為人工智能和深度學習工作負載提供了良好的並行處理能力。

存儲方面,基本模塊支持多達 8 個 2.5 英寸熱插拔 SAS/SATA/NVMe 驅動器,在存儲容量和速度之間提供平衡。

密集模塊

對於優先考慮並行 GPU 處理的組織,密集模塊可以支持多達 8 個雙寬、全高、全長 GPU。 每個 GPU 在 PCIe 交換機上使用 PCIe Gen5 x16,從而最大限度地增加單個服務器上的 GPU 數量,以增強並行處理能力。

在存儲方面,密集模塊具有多種用途。 它支持最多 6 個 EDSFF E1.S NVMe SSD 或最多 4 個 EDSFF E3.S 1T NVMe HS SSD。 此配置非常適合密集數據處理任務需要更多 GPU 但犧牲一定存儲靈活性的場景。

HGX模塊

HGX 模塊配置是專門的,針對具有特定 GPU 要求的高性能需求。 它利用 NVIDIA HGX H100 和 4 個 NVLink 連接的 SXM5 GPU。 這些 SXM5 GPU 可能會限制機箱中可安裝的總數,但它們提供卓越的芯片性能,使其成為要求苛刻的 AI 和深度學習任務的理想選擇。

在存儲方面,HGX 模塊針對速度進行了優化。 它最多可容納 4 個 2.5 英寸熱插拔 NVMe SSD 或最多 4 個 EDSFF E3.S 1T NVMe HS SSD。

關閉的思考

ThinkSystem SR675 V3的每個模塊配置都有其獨特的優勢。 雖然 HGX 模塊中的 SXM5 GPU 提供無與倫比的性能,但需要更多並行處理的組織可以選擇密集模塊來容納更多 PCIe GPU。 然而,這是以 TDP 損失和潛在性能下降為代價的。 基本模塊提供了一個中間立場,提供 GPU 支持和存儲選項的平衡。 與往常一樣,最佳選擇取決於手頭任務的具體要求和限制,我們永遠不會將這些配置中的任何一個踢出我們的實驗室。

參與 StorageReview

電子報| YouTube | PodcastiTunes / Spotify | Instagram | Twitter | TikTok | RSS訂閱

萊爾·史密斯

Lyle 是 StorageReview 的撰稿人,文章涵蓋了廣泛的終端使用者和企業 IT 主題。