NVIDIA RTX PRO 5000 72GB Blackwell GPU 现已正式上市,将 Blackwell 级别的计算能力带入更广泛的专业台式机领域。这款全新配置面向构建和部署智能体和生成式 AI 的技术用户,旨在解决内存受限的工作流程,满足上一代工作站 GPU 无法应对的需求。
通过与现有的RTX PRO 5000 48GB 型号相辅相成,72GB 版本为 AI 团队提供了一种简单的方法,可以根据模型复杂性、上下文长度和预算来调整配置。
专为智能体和多模态人工智能而设计
现代人工智能的发展正从独立模型转向能够协调工具、检索增强生成(RAG)和多模态流程的智能体系统。这些工作负载通常需要同时在GPU内存中保存多个模型、嵌入和应用程序逻辑,因此容量成为首要限制因素。
RTX PRO 5000 72GB基于 NVIDIA Blackwell 架构,旨在为 AI 推理和训练、神经渲染和模拟提供高吞吐量。其 AI 性能高达 2,142 TOPS,目标用户为运行以下应用程序的开发者:
- 具有扩展上下文窗口的大型语言模型
- 结合文本、图像和3D的多模态模型
- 将多个组件和工具串联起来的智能体人工智能系统
GPU 显存提升至 72GB,比 48GB 配置提升了 50%,这使得开发人员能够在本地对更大的模型进行微调、原型设计和部署。这可以减少每次迭代对数据中心基础设施的依赖,从而降低延迟,保持数据本地性,并有可能降低那些倾向于将开发和敏感工作负载保留在本地的团队的运营成本。
人工智能、渲染和工程性能
在本地人工智能开发中,原始计算能力和内存容量共同决定了哪些工作负载能够高效执行。RTX PRO 5000 72GB 显卡兼顾了这两个方面,拥有更高的人工智能吞吐量和足够的内存容量,能够让更大的模型驻留在内存中。
NVIDIA 报告称,在生成式 AI 基准测试中,72GB RTX PRO 5000 的性能表现如下:
- 图像生成性能最高可达上一代 NVIDIA 工作站 GPU 的 3.5 倍。
- 文本生成工作负载性能提升高达 2 倍
对于内容创作团队而言,GPU 性能直接影响迭代速度。在 Arnold、Chaos V-Ray 和 Blender 等路径追踪引擎以及 D5 Render 和 Redshift 等实时渲染器中,RTX PRO 5000 72GB 相较于上一代产品,渲染时间最多可缩短 4.7 倍。随着制作流程中越来越多地融入 AI 降噪器、生成式工具和复杂的光照模拟,这种加速尤为重要。
在计算机辅助工程 (CAE) 和产品设计中,GPU 的图形性能是上一代产品的 2 倍以上,能够实现更高保真度的可视化、更大的装配以及与复杂模型更快速的交互。
技术工作流程中的早期采用
工程设计与仿真:InfinitForm
InfinitForm是一家为工程设计提供生成式人工智能软件的公司,也是NVIDIA Inception计划的参与者,该公司是RTX PRO 5000 72GB显卡的早期采用者之一。该公司利用这款GPU来调整和优化其生成式设计工作流程,其中内存容量和计算吞吐量对于高级仿真和迭代设计探索至关重要。
通过将更大的模型和更复杂的仿真流程整合到单个工作站 GPU 上,InfinitForm 可以简化计算机辅助设计和制造流程,减少日常工程任务对外部计算资源的依赖。
虚拟制作与复杂3D:多功能媒体
专注于虚拟制作的全球媒体公司 Versatile Media 正在评估 RTX PRO 5000 72GB 显卡,用于实时渲染大规模场景和复杂资产。虚拟制作环境通常集成以下组件:
- 庞大的 3D 场景图和资源库
- 人工智能驱动的去噪和生成工具
- 实时物理和光照
72GB 的内存配置旨在将这些大型数据集驻留在 GPU 上,从而有助于保持交互性,并最大限度地减少在浏览或调整高分辨率场景时出现的卡顿。Versatile Media 计划使用这块新的 GPU 来驱动一系列复杂的高分辨率实时渲染场景,这些场景将同时考验内存容量和渲染吞吐量。
可用性
NVIDIA RTX PRO 5000 72GB Blackwell GPU 现已通过分销合作伙伴发售,包括 Ingram Micro、Leadtek、Unisplendour 和 xFusion。这为 OEM 厂商、制造商和系统集成商提供了一种构建 AI 就绪型工作站的新选择,适用于:
- 智能体和生成式人工智能开发
- 高端内容创作和虚拟制作
- 工程仿真、CAD 和 CAE
预计明年年初将开始通过全球系统集成商实现更广泛的供货。




Amazon