在 2025 年戴尔科技世界大会上,戴尔宣布了戴尔 AI 工厂的一系列改进,旨在加速企业 AI 的采用,并缩短价值实现时间。随着企业从 AI 实验走向全面实施,对便捷的 AI 技能和强大技术的需求空前高涨。戴尔携手 NVIDIA 推出涵盖 AI 基础设施、解决方案和服务的全面更新套件,旨在简化从试点项目到量产 AI 的整个流程。
下一代计算、存储和网络
戴尔推出了最新一代 PowerEdge 服务器,包括风冷式 XE9780 和 XE9785 型号,这两款服务器专为无缝集成到企业数据中心而设计。对于需要更高密度和效率的企业,液冷式 XE9780L 和 XE9785L 服务器支持机架级部署,最多可支持 192 个 NVIDIA Blackwell Ultra GPU,并采用芯片级直冷技术,每个戴尔 IR7000 机架最多可配置 256 个 GPU。这些新型号是戴尔增长最快的解决方案PowerEdge XE9680的升级版,并借助 8 路NVIDIA HGX B300显卡,将大型语言模型 (LLM) 的训练速度提升至四倍。
戴尔 PowerEdge XE9785
戴尔PowerEdge XE7745服务器将于2025年7月起搭载NVIDIA RTX Pro 6000 Blackwell Server Edition GPU,为物理和智能体AI应用场景提供通用平台。该服务器采用4U机箱,最多可支持8个GPU,专为机器人、数字孪生和多模态AI应用而设计,并已通过NVIDIA企业级AI工厂设计验证。戴尔还宣布计划支持NVIDIA Vera CPU(可提升速度、效率和性能)以及NVIDIA Vera Rubin平台,后者将与新款PowerEdge XE服务器配套,用于戴尔集成机架式可扩展系统。
戴尔扩展了其网络产品组合,推出了PowerSwitch SN5600 和 SN2201 以太网交换机(NVIDIA Spectrum-X 以太网网络平台的一部分)以及 NVIDIA Quantum-X800 InfiniBand 交换机。这些高密度、低延迟交换机可提供高达 800Gbps 的吞吐量,并且现在由戴尔 ProSupport 和部署服务提供支持,确保在 AI 部署生命周期内获得专家指导。
重新定义AI冷却和数据中心效率
戴尔还通过 PowerCool 封闭式后门热交换器 (eRDHx) 革新了数据中心的冷却方式,这是戴尔自主研发的标准后门热交换器替代方案。eRDHx 通过独立的气流系统捕获 100% 的 IT 热量,与传统解决方案相比,冷却能源成本可降低高达 60%。该技术集成到戴尔 IR7000 机架中,可帮助企业降低成本,无需购买昂贵的冷却器,并在更高的水温(32-36°C)下运行。
eRDHx 在不增加功耗的情况下,最多可支持 16% 的密集计算机架,并可将每机架的空气冷却能力提升至 80 kW,从而实现密集的 AI 和 HPC 部署。先进的泄漏检测、实时热监控和统一的机架管理功能进一步降低了运营风险。
PowerCool 封闭式后门热交换器 (eRDHx)
集成的端到端 AI 解决方案
戴尔 AI Factory 与 NVIDIA 强强联手,提供全面集成的端到端 AI 解决方案,融合戴尔和 NVIDIA 的计算、网络、存储以及 NVIDIA AI Enterprise 软件。该平台支持经 NVIDIA Enterprise AI Factory 验证的设计,为企业提供可扩展 AI 部署的坚实基础。
平台和服务创新
戴尔AI工厂现已增强了基于AMD的戴尔AI平台,引入了200G存储网络和升级版AMD ROCm开放软件栈。这简化了工作流程,支持LLM并管理复杂的工作负载,并为Llama 0等模型提供Day 4支持和性能优化的容器。全新基于英特尔的戴尔AI平台使企业能够使用英特尔Gaudi 3 AI加速器部署全面、高性能的AI堆栈。
戴尔还宣布与 NVIDIA 合作更新戴尔 AI 工厂,并对 Dell NativeEdge 进行增强,进一步支持边缘的 AI 部署和推理。
人工智能数据管理的进步
戴尔深知人工智能的有效性与数据的质量和可访问性息息相关,因此改进了其人工智能数据平台,以确保人工智能应用程序能够持续、高性能地访问数据。Dell ObjectScale 现已支持大规模人工智能部署,其密度更高的软件定义系统能够降低成本并减少数据中心占用空间。与 NVIDIA BlueField-3 和 Spectrum-4 网络的集成进一步提升了性能和可扩展性。
戴尔还推出了一款基于 PowerScale、Project Lightning 和PowerEdge XE服务器的高性能解决方案。该解决方案利用 KV 缓存并集成 NVIDIA 的 NIXL 库,针对大规模分布式推理工作负载进行了优化。Dell ObjectScale 将支持基于 RDMA 的 S3,与传统 S3 相比,吞吐量最多可提升 230%,延迟最多可降低 80%,CPU 负载最多可降低 98%,从而显著提高 GPU 利用率。
Agentic AI 的软件创新
NVIDIA AI Enterprise 软件平台可直接从戴尔获取,助力企业在戴尔 AI Factory with NVIDIA 平台上进行创新。这包括访问 NVIDIA NIM、NeMo 微服务、蓝图、NeMo Retriever for RAG 以及 NVIDIA Llama 和 Nemotron 等高级推理模型。这些工具支持无缝开发代理工作流,帮助企业加快 AI 驱动成果的价值实现时间。Red Hat OpenShift 现已在戴尔 AI Factory with NVIDIA 平台上提供,适用于注重灵活性和安全性的企业,简化关键的 AI 部署。
简化 AI 运营的托管服务
戴尔携手NVIDIA,为戴尔AI工厂推出全新托管服务,进一步降低运营复杂性。这些服务管理完整的NVIDIA AI解决方案堆栈,包括平台、基础架构和AI企业软件,并提供全天候监控、报告、版本升级和补丁安装。通过提供经济高效、可扩展且主动的IT支持,戴尔的托管服务可帮助企业克服资源和专业知识方面的限制,确保技术团队能够专注于通过AI驱动业务价值。




Amazon