Supermicro 推出了全新業務線—資料中心建置模組解決方案 (DCBBS),將完整資料中心的設計、採購和交付整合到一個供應商。該解決方案涵蓋伺服器、儲存、網路、管理軟體、液冷和站點基礎設施,所有組件均經過預先測試並在工廠整合。 Supermicro 推廣 DCBBS,旨在縮短上線時間、提高可維護性並提升整體建造質量,尤其註重能源效率和適用於 AI 工作負載的可擴展液冷系統。
Supermicro 執行長 Charles Liang 強調了公司與主要營運商合作的成功經驗,並將 DCBBS 描述為向全端基礎設施交付的自然演進。他指出,DCBBS 採用了節能元件、強大的管理軟體,以及專為最新高效能 GPU 和 CPU 設計的專用液冷技術。 Supermicro 聲稱,與傳統的空氣冷卻相比,這項技術可將資料中心的功耗降低高達 40%。
整合的、經過工廠驗證的 IT 堆疊
DCBBS 提供從機架到行列再到站點的端到端解決方案。 Supermicro 在出貨前整合並測試伺服器、儲存、結構、液冷、電源和管理。這種單一供應商方案簡化了採購和部署,同時降低了與多家供應商和整合工作相關的風險。從技術上講,其優勢在於使用經過測試的參考架構,該架構可以根據網站需求進行調整,而無需重新設計整合流程。
DCBBS 的關鍵組件
人工智慧和計算系統
Supermicro 的 AI 和運算系統採用密度優化的 1U 和 2U 平台、多 GPU 訓練節點以及可擴展系統,旨在提高效率並簡化維護。這些產品採用 NVIDIA、AMD 和 Intel 的最新加速器和 CPU,使客戶能夠選擇適合其工作負載的平台,從訓練大型語言模型到高效能運算、資料分析和企業任務。
對於 AI 資料工作流程,Supermicro 將運算能力與千萬億次級伺服器和物件儲存伺服器結合,並與各種軟體定義網路合作夥伴合作,以改善資料流並減少訓練延遲。熱量管理對其優勢至關重要;客製化的冷板和液冷系統旨在從源頭消除高達 98% 的組件熱量,確保在持續負載下實現可靠的性能,同時在不影響可靠性的情況下實現更高的機架密度。
機架內解決方案
Supermicro 的機架內冷卻系統專注於模組化冷卻液分配。冷卻液分配歧管 (CDM) 和冷卻液分配單元 (CDU) 提供多種配置,以適應不同的機架佈局和功率需求。垂直 CDM 旨在透過改善有限空間內的冷卻液佈線來提高伺服器密度。機架內 CDU 可支援高達 250 kW 的液體冷卻,冷卻液溫度可達 45°C,並配備備用電源和幫浦以確保可靠性,從而滿足企業正常運作時間目標。
後門熱交換器 (RDHx) 安裝在機架背面,從源頭去除熱量,從而減輕設施級 CRAC/CRAH 系統的負擔。這種方法對於無法進行大規模液體改造的現有系統尤其有益;操作員可以逐步引入更高密度的設備,且幾乎不會造成中斷。
網路選項包括 Supermicro 乙太網路交換機,每條鏈路速度高達 800 GbE,總交換容量高達 51.2 Tbps。對於有特定網路結構需求的客戶,我們也提供來自合作夥伴生態系統的 InfiniBand 和 Omni-Path 交換器。該系列產品為架構師提供了靈活性,可以根據廣泛的兼容性和不斷發展的 AI 流量管理需求,或在大規模訓練中保持效能的一致性來選擇合適的網路結構。
電力傳輸滿足 AI 工作負載的需求。 Supermicro 電源架採用標準機架尺寸,每個電源架的功率為 33 kW,符合近期 GPU 密集節點的電力需求。電池備用單元 (BBU) 電源架提供 48V 直流電,功率為 33 kW,可持續 90 秒,為系統提供檢查點狀態所需的時間,避免斷電期間昂貴的應用程式重新啟動。機架專為液冷伺服器打造,可與電源架和 BBU 預集成,以確保在整個部署過程中保持一致的機械、電氣和熱性能。
行內解決方案
對於超出機架內解決方案容量的集群,Supermicro 行內 CDU 可整合並管理跨多個機架的液體循環。這些裝置可消除伺服器產生的高達 1.8 MW 的熱量,並透過中央行級設備為多個高功率液冷機架供電。這種設計簡化了擴展:隨著工作負載和密度的增加,操作員可以添加機架並擴展行內循環,而無需重新設計整個冷卻裝置。
對於缺乏樓宇級液體冷卻系統的設施,液-氣 (L2A) Sidecar 系統提供了另一種選擇。這些獨立裝置可從伺服器中收集熱液體,並將熱量釋放到資料大廳的空氣中,每個 Sidecar 可冷卻高達 200 kW 的熱量。由於無需外部改造,L2A Sidecar 系統非常適合分階段改造、試點專案以及緊湊的主機託管空間。
在多機架層面,Supermicro SuperCluster 提供即插即用元件,將運算、儲存和網路結構整合在經過驗證的設計中。系統在出貨前會經過 L11/L12 測試,從而降低整合風險,並加速從交付到 AI 工作負載的營運過渡。這種方法使企業能夠從概念驗證無縫擴展到全面生產,而無需重新設計機架、佈線或網路結構配置。
站點基礎設施解決方案
DCBBS 涵蓋資料中心交換和佈線的設計和文件編制,包括流量工程、路由和連接埠對映以及電纜長度最佳化。透過事先確定這些方面並將其與工作負載通訊模式進行協調,Supermicro 致力於縮短上線時間、降低材料和人工成本,並提高可操作性。最終,我們打造出可靠、高效的交換結構,適用於分散式 AI 和分析工作負載,其範圍涵蓋不同的應用場景。
對於設施規模的熱管理,Supermicro 提供模組化水冷塔,可快速安裝和調整,從而隨著叢集擴展而提高容量。在水資源有限或節水至關重要的地區,乾式冷卻器可作為低 PUE 和低 WUE 的替代方案。這些裝置利用絕熱輔助空氣預冷技術,在高溫條件下保持高效,確保在季節和地理變化過程中保持穩定的性能。
500 千瓦至 3,000 千瓦的發電機系統確保電力連續性,其設計旨在快速啟動,適應高功率波動,並與自動轉換開關平穩整合。上游配電採用靈活的低阻抗變壓器,容量從 750 千伏安至 5,000 千伏安,配備智慧監控和環路供電選項,支援彈性多兆瓦級機組,並在分階段建設期間快速通電。
管理軟體套件
SuperCloud Composer(SCC)
SCC 是機架級管理在其整個生命週期內的控制中心。它集中監控和控制伺服器、網路、PDU、CDU 和冷卻塔,並與所選的第三方系統整合。 SCC 提供監控、電源管理和進階洩漏偵測功能,包括保護和警報,以保護 GPU 和冷卻系統。 SCC 可以透過單一入口網站管理超過 20,000 台主機,從而減少工具分散化並實現跨平台操作的標準化。
SuperCloud 自動化中心 (SCAC)
SCAC 提供現成的企業級自動化功能,涵蓋韌體基準測試、作業系統設定、Kubernetes 整合和 AI 工作負載的匯入。該平台優先考慮安全性、可擴展性和治理,支援一致的叢集設定和可重複的配置管理。透過使用範本執行常見任務,SCAC 縮短了從硬體到貨到應用程式就緒的時間。
SuperCloud 開發者體驗控制台 (SCDX)
SCDX 旨在提高開發人員效率,同時確保平台安全。它提供計算和儲存的自助存取、以 AI 為中心的資料準備、訓練和評估工作流程,以及內建監控功能。其目標是幫助團隊更快地從程式碼過渡到模型,同時確保共享基礎設施和合規性的必要保障。
超級雲端總監 (SCD)
SCD 充當多租戶 AI 雲端控制層,涵蓋裸機運算、乙太網路和 InfiniBand 網路以及各種儲存後端。它面向需要大規模交付 AI 服務,同時管理管理隔離、配額分配和生命週期控制的營運商。透過抽象基礎設施細節,SCD 使平台團隊能夠為內部部門和外部客戶提供統一的服務。
服務和現場部署
美超微全球服務提供全面的服務,涵蓋從裸地施工到氣液系統改造的各個環節。服務涵蓋資料中心設計、解決方案驗證、現場部署和持續支持,並為關鍵環境提供 4 小時現場回應選項。此服務模式旨在透過將整合和測試轉移到工廠來縮短交付週期,確保現場安裝過程可預測且有據可查。這可以縮短上線時間,並透過高效、可重複的交付方式提高安裝品質。
底線
DCBBS 標誌著 Supermicro 從伺服器供應商轉型為全端資料中心整合商,專注於液冷、高速結構和軟體驅動營運。對於正在擴展 AI 和高密度運算能力的企業而言,該產品提供了從採購訂單到營運集群的更快捷途徑,其採用經過驗證的建置模組,可降低風險、增強可維護性,並在數兆瓦規模下保持能源效率。




Amazon