惠普企业 (HPE) 宣布推出 HPE ProLiant Compute XD685,专为高级人工智能 (AI) 模型训练而设计,搭载第五代 AMD EPYC 处理器和 AMD Instinct MI5X 加速器。这款新系统经过优化,可快速部署高性能、安全且节能的 AI 集群,专为大型语言模型 (LLM) 训练、自然语言处理和多模式训练量身定制。
随着医疗保健、劳动力生产率和气候科学等行业的组织努力释放 AI 的全部潜力,对可扩展、高性能且可快速部署的解决方案的需求日益增长。AI 服务提供商、政府和大型模型构建者需要灵活、强大的系统来满足这些需求。
HPE 高级副总裁兼 HPC 和 AI 基础设施解决方案总经理 Trish Damkroger 强调了可扩展计算解决方案在 AI 发展中发挥的关键作用。她指出,作为高性能、节能系统的领导者,HPE 已通过 HPE ProLiant Compute XD685 扩展了其创新。该系统旨在支持不断增长的 AI 市场并加速科学和工程领域的突破。
AMD 数据中心解决方案事业部执行副总裁兼总经理 Forrest Norrod 强调了 HPE 与 AMD 之间的紧密合作伙伴关系。据 Norrod 介绍,搭载最新 AMD EPYC 处理器和 Instinct 加速器的 HPE ProLiant Compute XD685 可提供无与伦比的 AI 性能和效率,帮助客户更快地将 AI 解决方案推向市场并推动行业创新。
HPE ProLiant Compute XD685 的主要功能
HPE ProLiant Compute XD685 专为加速大型 AI 模型训练和调优项目而设计。它采用模块化 5U 机箱,可缩短 AI 解决方案的上市时间,并为各种 GPU、CPU、组件、软件和冷却方法提供灵活性。此外,HPE 集成了直接液冷技术和安全创新,使系统既高性能又安全。
HPE ProLiant Compute XD685 旨在提供卓越的 AI 性能,同时降低硬件要求。它采用 AMD CDNA 3 架构和 AMD Instinct MI325X 加速器,使组织能够使用更少的 GPU 运行最大的 AI 模型。这些加速器具有 HBM3E 内存,可提供 6 TB/s 的内存带宽。这确保更快地处理训练和推理任务,显著提高整体性能,同时降低总拥有成本 (TCO)。
对于能源和冷却需求苛刻的组织,HPE 提供直接液体冷却以提高效率。这种冷却解决方案可帮助公司满足不断增长的电力需求和可持续发展目标,同时降低运营成本。凭借 HPE 在部署一些全球最大的液冷 IT 基础设施方面数十年的专业知识,ProLiant Compute XD685 利用这种尖端冷却技术来提高性能和环境效率。
为了进一步加速 AI 集群部署并简化运营,HPE 提供了全面的可定制服务。这些服务涵盖从构建和集成解决方案到部署前在工厂进行全面测试和定制的所有内容。通过在整个过程中提供专家指导,HPE 确保大型 AI 集群可以稳定且卓越地部署在世界任何地方,从而缩短上市时间并提高运营成果。
安全性也是 HPE 的首要任务,ProLiant Compute XD685 通过 HPE iLO 提供强大的保护。此集成管理平台可确保系统从端到端得到安全管理。安全功能内置于硬件中,从供应链层面开始一直延伸到硅片,为当今环境中日益增长的网络安全威胁提供强大的保护。
HPE ProLiant Compute XD685 还可在 5U 机箱中最大化机架密度,该机箱支持每机架 8 个节点,用于 325 路 GPU 系统。这种设计使系统可容纳多达 300 个 AMD Instinct MI9005X 或 MIXNUMXX 加速器和两个最新的 AMD EPYC XNUMX 系列处理器。根据具体要求,客户还可以选择空气冷却或直接液体冷却,从而优化其基础设施的性能和效率。
HPE Performance Cluster Manager 是一款完全集成的系统管理软件,可简化大型 AI 集群的管理。此工具可自动从裸机设置复杂系统,实现快速部署,同时确保集群保持运行。详细的遥测、GPU 压力测试和其他高级功能可确保 AI 系统平稳运行,为客户提供可靠且可扩展的解决方案,以应对最具挑战性的 AI 工作负载。
可用性
HPE ProLiant Compute XD685 现已通过 HPE 订购,并将于 2025 年第一季度全面上市。




Amazon