存儲評論網

超微擴展風冷解決方案並推出全新AI工廠集群

企業  ◇  伺服器

Supermicro 發布了基於 AMD 的 Instinct MI350 系列 GPU 優化解決方案的最新成員。此次更新預計將帶來更高的效能、更強的可擴充性和更高的能源效率。 Supermicro 為需要 AMD Instinct MI355X GPU 的高階效能,但又需要風冷環境的企業用戶設計了這款全新系統。

Supermicro技術與人工智慧高級副總裁Vik Malyala強調了該公司在高效能人工智慧和高效能運算解決方案方面豐富的經驗。他指出,Supermicro的資料中心基頻(DCBBS)能夠將先進技術與成熟的資料中心解決方案結合,從而實現AMD解決方案的快速整合。這次推出的全新風冷式AMD Instinct MI355X GPU系統進一步豐富了Supermicro的人工智慧產品組合,為客戶建置新一代資料中心提供了更多選擇。

擴展型液冷和風冷伺服器

Supermicro 正在擴展其高效能產品線,推出採用業界標準 OCP 加速模組 (OAM) 的全新 10U 風冷和液冷伺服器。這些 GPU 伺服器每個 GPU 配備 288GB HBM3e 記憶體,頻寬高達 8TB/s,TDP 從 1000W 提升至 1400W,效能最高可達風冷 8U MI350X 系統的兩倍。為採用 MI355X 晶片的 GPU 伺服器增加 10U 選項,無論採用風冷或液冷配置,均可實現更高的單機架效能。

AMD宣布與Supermicro合作推出風冷式AMD Instinct MI355X GPU,設計提升現有資料中心基礎架構的AI效能。 AMD資料中心GPU業務發展副總裁Travis Karr強調,此次合作旨在引領效能與效率的提升,為全球客戶提供先進的AI和高效能運算解決方案。

這些GPU解決方案旨在為雲端服務供應商和企業提供大規模AI和推理的卓越效能。 Supermicro加速AI伺服器產品組合擴展,搭載AMD Instinct MI350系列GPU,凸顯了基於Supermicro DCBBS架構和AMD最新第四代CDNA架構的下一代資料中心解決方案,再次率先將先進的AI解決方案推向市場。

搭載 AMD Instinct MI355X GPU 的 Supermicro 10U 伺服器目前已開始出貨。

新型人工智慧工廠集群解決方案

Supermicro 發布了全新的交鑰匙解決方案,旨在簡化部署流程並加快 AI 工廠的搭建速度。這些完全整合的機架式叢集是基於 NVIDIA 企業參考架構和 Blackwell GPU,包含 NVIDIA 軟體和 Spectrum-X 乙太網路。它們經過驗證,並以完整解決方案的形式交付。 Supermicro 的 DCBBS 進一步簡化了將資料中心改造為 AI 工廠的流程,縮短了交付週期並減少了供應商協調工作。

Supermicro 執行長 Charles Liang 強調了該公司在快速交付新型 GPU 技術方面的領先地位,特別是基於 NVIDIA GB300 NVL72 和 HGX B300 的 AI 基礎設施。他強調,這些進步對於在各行業普及 AI 至關重要,AI 工廠將成為企業轉型為 AI 企業的基礎。梁志強指出,透過與 NVIDIA 和 Supermicro 的資料中心建置模組解決方案合作,這些努力有助於加速和簡化 AI 部署,實現業界領先的上線時間。

Supermicro 提供採用 NVIDIA 認證系統和 Blackwell GPU 的 AI 工廠解決方案,這些解決方案針對電力、散熱和空間限制的環境進行了效能和效率最佳化。這些解決方案採用 Spectrum-X 網絡,並基於 NVIDIA 企業參考架構,配備 RTX PRO 6000 Blackwell 伺服器版 GPU 和 HGX B200.AI 工廠叢集。

Supermicro AI 工廠叢集解決方案預先配置為可擴充單元,提供小型、中型和大型配置,從 4 個節點 32 個 GPU 到 32 個節點 256 個 GPU 不等。

這些叢集在Supermicro的全球站點經過L12級安全測試,包含NVIDIA AI Enterprise、Omniverse、Run:ai、Spectrum-X乙太網路以及全套線纜,可實現即插即用,從第一天起即可產生代幣。 Supermicro為AI資料管道的各個階段提供儲存解決方案,支援NVIDIA AI資料平台和AI工廠內的AI工作流程。

Supermicro 目前正在接受 AI 工廠叢集解決方案的訂單,提供 4 節點、8 節點和 32 節點配置,配備 NVIDIA RTX PRO 6000 Blackwell Server Edition 或 NVIDIA HGX B200 GPU,針對任何規模的 AI 和 HPC 工作負載進行了最佳化。

英偉達 HGX

通用型人工智慧、高效能運算和視覺運算叢集採用 NVIDIA RTX PRO 6000 Blackwell 伺服器版 GPU,基於 Supermicro 的 4U 和 5U PCIe GPU 系統建置。每個節點配備 8 個 GPU,採用 2-8-5-200(CPU-GPU-網卡-頻寬)配置,這些解決方案支援人工智慧推理、企業級高效能運算以及圖形和渲染工作負載,使企業能夠利用共享基礎設施運行多個應用程式。

基於Supermicro 10U模組化GPU平台,配備NVIDIA HGX GPU的高效能AI和HPC叢集。每個節點包含一塊NVIDIA HGX B200 8GPU,並支援NVIDIA NVLink,實現GPU間最大程度的通訊。這些叢集針對AI模型微調和訓練以及HPC工作負載進行了最佳化。

有關 Supermicro AI Factory 叢集解決方案的更多信息,請訪問Supermicro AI Factory 網站。

參與 StorageReview

電子報| YouTube | PodcastiTunes / Spotify | Instagram | Twitter | TikTok | RSS訂閱

哈羅德弗里茨

自 IBM 創建 Selectric 以來,我一直在科技行業工作。 不過,我的背景是寫作。 因此,我決定退出售前業務,回歸本源,從事一些寫作工作,但仍從事技術工作。