存储评论网

Supermicro H15 服务器搭配第六代 EPYC 处理器、MI350P GPU 系统和 Helios 机架

企业版  ◇  服务器

Supermicro 发布了全新的 H15 服务器产品组合,该产品组合基于第六代 AMD EPYC 9006 系列 CPU。这些服务器旨在与 AMD Instinct GPU 和 AMD Pensando 网络解决方案协同工作。此外,Supermicro 还扩展了其 AMD GPU 产品线,推出了专为 AMD Instinct MI350P GPU 打造的全新 PCIe GPU 服务器,以及此前发布的 Supermicro AMD Helios 机架式平台(该平台集成了 AMD Instinct MI455X GPU)。本次发布会详细介绍了 CPU 平台、GPU 和网络硬件,以及集成这些组件的机架式系统,该系统面向智能体 AI、云计算、企业级应用和高性能计算 (HPC) 工作负载。

Supermicro H15 系列,配备 Epyc 9000 CPU

H15架构和CPU平台

H15架构基于Supermicro的数据中心构建模块解决方案(DCBBS),该方案在其服务器产品系列中实现了模块化机架级部署的标准化,而非单独设计每个机箱。H15系统支持第六代AMD EPYC 9006系列处理器,每个插槽最多可配备256个核心和512个线程。Supermicro表示,该系列处理器性能比上一代产品提升高达1.7倍,同时提供更大的内存和I/O带宽。该公司的核心信息很简单:每个插槽增加核心数和内存带宽,使用户能够在不超出功耗限制的情况下,在每个节点上运行更多AI代理或企业级工作负载。这一点至关重要,因为数据中心的电力供应通常限制的是机架容量,而非计算密度。

H15产品组合中的六种系统类型

Supermicro 将 H15 产品线分为六大系统类别,每个类别都针对特定的部署场景量身定制。Hyper 平台是旗舰级双路机型,专为企业应用、AI 推理、虚拟化和云工作负载而设计,其散热设计能够支持顶级 AMD EPYC 处理器。CloudDC 提供单路和双路版本,并符合开放计算项目 (OCP) 的数据中心模块化硬件系统 (DC-MHS) 标准,可与其他符合 OCP 标准的数据中心组件互操作,而无需将用户限制在 Supermicro 特定的机架系统中。

超微 H15

GrandTwin 是一款高密度 2U 四节点系统,专为对象存储、虚拟化、云服务和高性能计算 (HPC) 等横向扩展工作负载而设计。FlexTwin 则提供更紧凑的 1U 双节点双 CPU 配置,采用液冷散热,专为云原生和超大规模环境量身打造,在这些环境中,机架密度和能效比节点灵活性更为重要。Supermicro 的 Petascale 存储系列完善了其非 GPU 产品组合,提供 1U 和 2U 外形尺寸的高容量全闪存平台,每个系统最高支持 4.8PB 的存储容量,适用于 AI 数据湖、大规模分析和 HPC 存储。这些平台基于软件定义存储而非固定硬件 RAID 构建。

H15 8U 10节点超级刀片服务器是该产品组合中的机架级刀片服务器系统,支持单路和双路刀片配置,并提供风冷或液冷选项。它专为高性能计算 (HPC)、人工智能推理、智能体人工智能和企业计算等领域的混合 CPU 和 GPU 部署而设计,无需完整的 GPU 机架即可实现高刀片密度。

适用于 AMD Instinct MI350P 的新型 PCIe GPU 服务器

Supermicro 推出了两款 5U PCIe GPU 服务器 AS-5126GS-TNRT 和 AS-5126GS-TNRT2,均搭载 AMD Instinct MI350P PCIe GPU。每台服务器均可在标准的 5U 风冷机箱内支持多达 10 个 GPU,与现有数据中心的散热和电源配置兼容,无需液冷。MI350P GPU 提供高达 144GB 的 HBM3e 显存,并支持低精度 AI 数值格式,因此适用于推理和训练工作负载,在这些工作负载中,内存容量而非原始计算能力往往是限制因素。

通过 Pensando Pollara 400 实现开放式以太网连接

Supermicro 的 MI350P 系统采用 AMD Pensando Pollara 400 AI 网卡,这是一款专为 AI 基础设施设计的开放式以太网网卡。它负责管理 MI350P 部署中的前端、存储和横向扩展流量。由于 Pollara 400 采用标准以太网而非专有互连技术,因此客户无需受限于封闭的网络协议栈,即可将集群从单服务器扩展到多机架配置。Supermicro 和 AMD 强调,这种灵活性是其相对于仅限于单一 GPU 供应商生态系统的互连方案的关键竞争优势。

Supermicro AMD Helios:72 GPU 机架式平台

Supermicro 与 AMD 合作开发的 AMD Helios 平台是一款液冷式 72 GPU 机架系统,采用 AMD Instinct MI455X GPU、第六代 AMD EPYC 处理器、AMD Pensando 网络以及 AMD ROCm 软件套件。它面向使用前沿模型的企业,提供大规模 AI 训练和高吞吐量推理解决方案,并可从单机架扩展到更大的多机架 AI 集群。Helios 和新款 PCIe GPU 服务器满足不同的部署需求:MI350P PCIe 系统适用于在现有风冷配置中扩展 GPU 推理或训练的企业,而 Helios 则适用于构建更大规模专用液冷 AI 集群的企业。

Supermicro总裁兼首席执行官梁志强解释说,H15的发布重点在于构建专为高性能、可扩展性和高效率而设计的基础设施,尤其是在智能AI应用日益普及的背景下。他强调,DCBBS架构是实现高性能并支持灵活机架级部署的关键。此外,他还提到Supermicro的全球服务和美国供应链为客户部署和扩展AI基础设施提供了至关重要的支持。

AMD高级副总裁兼计算与企业人工智能总经理丹·麦克纳马拉强调,企业若要扩展智能体人工智能,就需要能够提供高性能、高效率和灵活部署的基础设施。他阐述了如何将AMD的EPYC CPU、Instinct GPU和Pensando网络与Supermicro的模块化服务器和机架式设计相结合,从而加速人工智能基础设施的部署,同时提高资源利用率、能源效率并降低总体拥有成本。

参与 StorageReview

电子报| YouTube | 播客iTunes / Spotify | Instagram | Twitter | TikTok | RSS订阅

哈罗德弗里茨

自 IBM 创建 Selectric 以来,我一直在科技行业工作。 不过,我的背景是写作。 因此,我决定退出售前业务,回归本源,从事一些写作工作,但仍从事技术工作。