存储评论网

从企业级到 SFF:NVIDIA 推出 RTX PRO 6000、4000 SFF 和 2000 Blackwell GPU

AI  ◇  企业版

NVIDIA 正在扩展其专业 GPU 产品线,推出面向大型数据中心和紧凑型工作站的新硬件。在 SIGGRAPH 2025 大会上,公司发布了面向企业服务器的 RTX PRO 6000 Blackwell 服务器版,以及两款全新桌面 GPU:RTX PRO 4000 小型化 (SFF) 版和 RTX PRO 2000 Blackwell。这些新品发布彰显了 NVIDIA 致力于在从 AI 模型训练和工业仿真到工程设计和媒体制作等各种专业工作负载中提供 Blackwell 架构性能的决心。除了硬件之外,NVIDIA 及其合作伙伴还重点关注集成的 AI 软件平台,使这些 GPU 能够加速从生成式 AI 到机器人技术和物理 AI 应用等各种应用。

NVIDIA 2U RTX PRO 服务器

NVIDIA RTX PRO 6000 Blackwell 服务器版:数据中心的全新动力

NVIDIA 已确认其 RTX PRO 6000 Blackwell 服务器版 GPU 将很快应用于各种主流企业服务器,将其最新的 GPU 架构引入 2U 机架系统(这是部署最广泛的服务器规格之一)。这些新配置旨在帮助企业从传统的纯 CPU 数据中心配置过渡到 GPU 加速平台。

RTX PRO 6000 基于 NVIDIA Blackwell 架构,配备 24,064 个 CUDA 并行处理核心,能够处理各种高要求的工作负载。它包含 752 个第五代 NVIDIA Tensor Core,用于加速 AI 训练和推理,以及 5 个第四代 RT Core,用于实时光线追踪。规格方面,它提供每秒 188 万亿次浮点运算的单精度 (FP117) 性能、每秒 32 千万亿次浮点运算的 FP3.7 AI 性能以及每秒 4 万亿次浮点运算的 RT Core。凭借这样的组合,该卡能够出色地完成需要高强度计算和高端渲染的任务。

NVIDIA RTX PRO 6000 Blackwell 服务器版芯片

内存容量为 96GB GDDR7,并配备 ECC 纠错码,以提高处理过程中的数据完整性。凭借 512 位内存接口和 1,597 GB/s 的带宽,该 GPU 能够传输大型数据集,这对于模拟、AI 模型训练和高分辨率可视化至关重要。该设计支持 vGPU 和最多四个多实例 GPU (MIG) 分区,每个分区配备 24GB 专用内存,使隔离的工作负载能够在同一物理卡上同时运行。视频和图像处理任务通过四个 NVENC 编码器、四个 NVDEC 解码器和四个 JPEG 引擎加速。

安全性和可靠性功能包括支持机密计算、基于信任根的安全启动以及用于高速连接的 PCI Express 5.0 x16 接口。该卡通过四个 DisplayPort 2.1 接口输出,尺寸为 4.4 英寸高,10.5 英寸长,可采用双插槽配置。采用被动散热设计,并通过单个 PCIe CEM5 16 针接口供电,功耗可配置高达 600 瓦。

思科、戴尔科技、HPE、联想和超微等公司将率先搭载全新 2U RTX PRO 服务器,每台服务器均支持 RTX PRO 6000 Blackwell GPU 的各种配置。该架构旨在加速广泛的工作负载,包括 AI 模型训练和推理、数据分析、科学模拟、逼真渲染、工业机器人以及其他形式的“物理 AI”开发。

NVIDIA RTX PRO 6000 Blackwell 服务器版
GPU架构 NVIDIA Blackwell 架构
CUDA 并行处理核心 24,064
NVIDIA 张量核心 752(第四代)
NVIDIA RT 核心 188(第四代)
单精度性能(FP32) 117 TFLOPS
峰值 FP4 AI PFLOPS 3.7 浮点数
RT核心性能 354.5 TFLOPS
GPU内存 96 GB GDDR7 带 ECC
存储器接口 512 bit
内存带宽 1597 GB /秒
能量消耗 高达 600W(可配置)
多实例GPU 最多 4 个 MIG @ 24GB
NVENC | NVDEC | JPEG 4倍 | 4倍 | 4倍
机密计算 支持
具有信任根的安全启动
图形总线 PCI Express 5.0x16
显示连接器 4个DisplayPort 2.1
外形 4.4 英寸(高)x 10.5 英寸(长),双插槽
散热解决方案 被动
电源连接器 1 个 PCIe CEM5 16 针

与上一代 NVIDIA L40S GPU 相比,性能提升相当显著。全新第五代 Tensor Core 和第二代 Transformer Engine,支持 FP5 精度,推理速度最高可提升六倍。第四代 RTX 图形技术可将渲染和可视化吞吐量提升四倍。

除了性能提升外,全新 RTX PRO 6000 系统还经过精心设计,以提升效率。NVIDIA 指出,与仅配备 CPU 的 18U 服务器相比,其能效最高可提升 2 倍,这对于空间和电力受限的设施尤为重要。速度与效率的平衡对于大规模仿真、合成数据生成和机器人训练等工作负载至关重要,因为这些工作负载的生成速度至关重要。

HPE 将把这款 GPU 集成到其 ProLiant Compute 产品线中,包括支持两块 RTX PRO 385 GPU 的全新 11U RTX PRO 规格 DL6000 Gen2,以及支持多达八块 GPU 的 380U 规格 DL12a Gen4。这些系统将与 HPE 的私有云 AI 平台兼容,该平台增加了对 NVIDIA 最新 AI 模型的支持,包括用于代理 AI 的 Nemotron、用于机器人技术的 Cosmos Reason,以及更新的视频搜索和摘要工具。

这些服务器型号的发货开始于 2025 年 9 月 2 日.

NVIDIA RTX PRO 4000 SFF 和 RTX PRO 2000 Blackwell GPU:紧凑型工作站加速

除了专注于服务器的发布之外,NVIDIA 还扩展了其桌面 GPU 产品线,推出了两款针对专业工作站的基于 Blackwell 的全新型号:RTX PRO 4000 SFF Edition 和 RTX PRO 2000。这两款产品旨在将下一代 AI 和图形加速的优势带给工程、媒体制作和建筑等行业的紧凑、节能工作站。

RTX PRO 4000 SFF 版尺寸仅为标准 GPU 的一半,同时保留了第四代 RT Core 和第五代 Tensor Core。与上一代产品相比,它的 AI 性能提升高达 4 倍,光线追踪性能提升 2.5 倍,内存带宽提升 1.7 倍;所有功能均在 1.5W 的功率范围内实现。

RTX PRO 2000 瞄准主流设计和 AI 任务,NVIDIA 声称其 1.6D 建模速度比上一代提升了 3 倍,CAD 性能提升了 1.4 倍,渲染速度也提升了 1.6 倍。此外,它还显著提升了生成式 AI 工作负载,图像创建速度提升了 1.4 倍,文本生成速度提升了 2.3 倍,从而实现了更快速的原型设计和迭代。

NVIDIA 表示,Mile High Flood District、坎塔布里亚政府地理空间办公室以及 Studio Tim Fu 等设计工作室进行的实际测试证明了该卡在处理大型数据集、地理空间工作负载和 AI 驱动设计工作流程方面的实用性。工程公司 Thornton Tomasetti 的基准测试表明,RTX PRO 2000 的结构分析速度比上一代产品快近三倍,比基于 CPU 的方法快 27 倍以上。

预计两种型号均有供应 今年晚些时候 通过主要的 OEM 和分销合作伙伴。

SIGGRAPH 焦点:物理 AI 时代的工作站

在 SIGGRAPH 大会上,NVIDIA 强调了其 RTX PRO 工作站系列(包括全新的 RTX PRO 4000 SFF 和 RTX PRO 2000)在支持专业 AI 和模拟工作流程方面发挥的作用。除了硬件之外,NVIDIA 还将其软件生态系统定位为推动应用的核心驱动力。

NVIDIA AI Enterprise 套件提供跨基础架构开发和扩展 AI 的工具,而 Cosmos 平台则为机器人、自动化和边缘 AI 提供优化的基础模型。Omniverse 平台仍然是 3D 仿真、协同设计和数字孪生工作流程的核心,可直接与硬件的 AI 功能集成。

这种紧凑高效的 GPU 与成熟的 AI 软件堆栈的组合,展现了行业正在发生的巨大变化。AI 加速计算不再仅限于大型数据中心。从生成式 AI 内容创作到机器人模拟,小型工作站如今也能处理过去需要更大、更耗电的系统才能完成的任务。

戴尔携手 NVIDIA 和 Elastic 扩展 AI 数据平台

同时,戴尔还宣布了其 AI 数据平台的更新。该平台由 NVIDIA 和 Elastic 共同打造,旨在处理从数据提取到推理的整个 AI 工作流程。全新的非结构化数据引擎(由 Elastic 的矢量搜索提供支持)新增了语义检索和混合关键词搜索功能,能够更快、更准确地访问大规模非结构化数据集。它采用 GPU 加速,并与联合 SQL 引擎、大规模数据处理和高速 AI 就绪存储等现有工具协同工作。

该平台现已集成 NVIDIA AI 数据平台参考设计,提供经过验证的架构,集存储、计算、网络和 AI 软件于一体。首款采用此配置的硬件将是戴尔 PowerEdge R7725,这是一款 2U 服务器,配备 NVIDIA RTX PRO 6000 Blackwell 服务器版 GPU 如上所述。这些系统针对大型语言模型推理、工程模拟以及使用 NVIDIA NeMo 和 Cosmos 等模型的 AI 推理等工作负载。

戴尔报告称,RTX PRO 6000 可提供高达六倍的 LLM 令牌吞吐量,将工程仿真性能提高一倍,并支持四倍的并发 MIG 用户数,相比上一代产品有所提升。将 R7725 与更新后的平台配对,可提供更快的推理速度、响应式语义搜索,以及无需定制系统设计即可处理更大规模 AI 工作负载的能力。

在 SIGGRAPH 2025 上,戴尔将与其戴尔 Pro Max PC 系列一起展示这些功能,该系列很快将添加带有 GB10 AI 开发工作站的紧凑型 Pro Max。

HPE 将 RTX PRO 6000 Blackwell 引入 ProLiant 服务器

最后,HPE 的 NVIDIA AI 计算产品组合新增了新功能,也带来了 RTX PRO 6000 Blackwell 服务器版 GPU 其 ProLiant Compute 服务器采用 2U 规格。将提供两种配置。ProLiant DL385 Gen11 采用全新的 6000U RTX PRO 服务器规格,最多可容纳两块 RTX PRO 2 GPU;而 ProLiant DL380a Gen12 采用 4U 设计,最多可容纳八块 GPU。这些服务器将于 2 年 2025 月 XNUMX 日开始发货。

这些服务器专为处理各种工作负载而设计,从生成式和代理式人工智能到机器人技术、工业应用、仿真和视觉计算。Gen12 ProLiant 型号包含分层安全功能,例如带有硅信任根 (Silicon Root of Trust) 的 HPE Integrated Lights Out (iLO) 7、安全区域 (Secure Enclave) 和抗量子固件签名。HPE Compute Ops Management 增加了集中式部署和维护自动化功能,从而缩短了服务器管理时间并减少了停机时间。

HPE还预览了其与NVIDIA联合开发的下一代私有云AI平台。此次更新将支持RTX PRO 6000 GPU,提供跨代GPU的无缝可扩展性,并包含隔离管理和企业多租户等功能。该平台将兼容NVIDIA最新的Nemotron智能代理AI推理模型、Cosmos Reason视觉语言模型(用于机器人和物理AI),以及更新的视频搜索和摘要蓝图(VSS 2.4)。这些新增功能旨在帮助企业快速部署能够处理和分析大量视频和视觉数据的AI代理。

NVIDIA RTX PRO 6000 Blackwell 服务器版

参与 StorageReview

资讯订阅 | YouTube | 播客 iTunes/Spotify | Instagram | Twitter(现为X) | TikTok | RSS订阅

莱尔·史密斯

Lyle 是 StorageReview 的撰稿人,文章涵盖了广泛的终端用户和企业 IT 主题。