存储评论网

联想 ThinkStation P920 塔式工作站评测 Quadro RTX 8000

电子消费品  ◇  打标工作站

Lenovo ThinkStation P920 塔式工作站是一个野兽,具有高度可配置性,可以处理大量数据并快速处理许多不同类型的工作负载。 拥有多达三个 NVIDIA Quadro GV100,您将拥有 NVIDIA 为需要极快 HBM2 内存的工作负载打造的最强大的 GPU; 或者,如果您的工作负载只需要大量 GPU 内存,您可以通过随附的 NVLink 获得两个 NVIDIA Quadro RTX 8000,总共 96GB 的视频内存。 如果您的工作负载更受 CPU 限制,联想也可以满足您的需求,支持多达两个 Xeon Platinum 8280,用于 56GHz 的 112 核和 4.0 线程。

P920工作站

该工作站的用例范围从建筑设计到 CAD,再到好莱坞级 VFX,或者只是编辑 8K 高分辨率素材。 无论您的个人用例是什么,这些都可以在定制配置中使用。 基本配置起价为 2,354.22 美元(截至 2020 年 4,059 月,正常建议零售价为 50,000 美元,但经常打折),但如果您真的愿意,您可以轻松勾选所有选项并飙升至 XNUMX 美元以上; 老实说,谁不喜欢摆弄在线配置器看看你能飞多高?

本次评测我们将重点关注这台机器的媒体和内容创作功能,包括Blender渲染、DaVinci Resolve处理8K RED素材的性能、V-Ray以及其他一些可能与您的工作相关的软件。这是我们对这套系统的后续评测,您可以在这里找到我们之前对P920的评测。

Lenovo ThinkStation P920 塔式规格

外形尺寸 塔
处理器 最多双英特尔白金、金牌、银牌和铜牌(最多 28 个内核,每个 CPU 最高 4.4 GHz)
运行系统 适用于工作站的 Windows 10 Pro(可通过 Microsoft 升级)
带有 Nvidia RAPIDS 的 Ubuntu Linux1(预加载)
Redhat Linux(已认证)
内存 高达 2TB DDR4 2933 MHz,16 个 DIMM(同时支持 RDIMM 和 LRDIMM,最大 256GB DDR4 ECC 3DS-RDIMM)
芯片组 英特尔C621
存放
max. 最多 12 个驱动器 最多 4 个内部存储托架
最大板载 M.2 = 2 (4TB)(使用 PCIe 适配器最多 9 个)
最大 3.5″ HDD = 6 (60TB)
最大 2.5″ SSD = 10 (20TB)
最大 PCIe AIC = 2 (960GB)
支持的驱动器媒体 3.5″ SATA HDD 7200 rpm 高达 6TB
2.5″ 10k SAS 硬盘高达 600GB
2.5″ SATA 固态硬盘高达 2TB
M.2 PCIe 固态硬盘高达 1TB
PCIe 附加卡高达 480GB
可移动存储 9 合 1 媒体卡(标准)
15 合 1 媒体读卡器(可选)
9.5 毫米超薄 ODD(可选)
支持RAID 0,1,5,6,10
电源 14000W @ 92%
图像 NVIDIA Quadro GV100 32GB
NVIDIA Quadro RTX 8000 48GB
NVIDIA Quadro RTX 6000 24GB
NVIDIA Quadro P6000 24GB
NVIDIA Quadro RTX 5000 16GB
NVIDIA Quadro P5000 16GB
NVIDIA Quadro RTX 4000 8GB
NVIDIA Quadro P4000 8GB
NVIDIA Quadro P2200 5GB
NVIDIA Quadro P1000 4GB
NVIDIA Quadro P620 2GB
端口
面前 4 个 USB 3.1 Gen 1(A 型)
全向麦
耳机
2 个 USB-C/Thunderbolt 3(可选)
媒体读卡器
后 4 个 USB 3.1 Gen 1(A 型)
2 x的USB 2.0
USB-C(可选)
迅雷 3(可选)
串行(可选)
并行(可选)
2个PS / 2
2 个以太网
音频输入
音频线路输出
麦克风
eSATA(可选)
火线(可选)
可选的附加连接 英特尔无线 8265 AC WIFI + 蓝牙 4.2
英特尔 I210-T1 单端口千兆以太网适配器
英特尔 I350-T2 双端口千兆以太网适配器
英特尔 I350-T4 四端口千兆以太网适配器
X540-T2 双端口铜缆
扩展插槽 5 个 PCIe x16 第三代
3 个 PCIe x4 第三代
尺寸(WxDxH) 7.9” x 24.4” x 17.6”(200 毫米 x 620 毫米 x 446 毫米)
安保防护 可信平台模块2.0
串行、并行、USB、音频、网络、启用/禁用端口控制
开机密码
设置密码
保修政策 3的一年

另外,请查看这份方便的 PDF 文件,其中包含截至 2020 年 6 月 P920 的完整可配置规格(内容非常丰富;我们之前关于其可配置性的说法并没有夸大其词)。

设计与建造

Lenovo ThinkStation P920 是一款塔式工作站,它的构造就像一个坦克。 它主要由钢制成,重量也与坦克一样重,最重的配置超过 80 磅(> 37 千克)。 这绝对是一台联想机器,外壳周围有黑色和红色亮点。 它低调而且不会在您的工作站上大惊小怪,除了它的巨大尺寸。

联想 ThinkStation P920 背面

工作站的后部主要是通风(这是它绝对需要的)和足够数量的 I/O。 它还暗示了这台机器可以在两个 Quadro RTX 8000 可见的地方发挥的性能。 同样可见的是它的 8 个 PCIe 插槽和一个用于可选串行端口的穿孔。

联想 ThinkStation P920 打开

机器内部布局合理,PCIe插槽和DIMM插槽方便进出,方便日后升级扩容。 此外,前面的 FlexBays 和用于不同配置的存储驱动器的空间也很容易访问。 整个东西是令人难以置信的模块化,几乎所有用户可维修或 IT 可维修的东西都是无需工具的,包括整个 PSU 和机箱风扇。

说到风扇,在我们广泛的测试中,这台机器保持安静。 即使在满载情况下,GPU 风扇也几乎没有加速,同时保持了全部性能。 诚然,您可能会在两个处理器和两个 GPU 承受压力时为单户住宅供暖,但这实际上只是在人工压力测试或渲染下,而不是正常工作的典型情况。 说到工作,让我们谈谈好事吧!

联想 ThinkStation P920 性能

我们在这里测试的配置几乎是顶级配置,但更适合 GPU 繁重的工作负载,特别是需要大量 VRAM 的 CUDA 加速任务,而不是 CPU 繁重的工作负载。 我们的系统运行 Windows 10 企业版,配备两个 Xeon Gold 6234 (8c/16t),总计 16c/32t,192GB DDR4-2933,一个 1TB NVMe SSD,以及 pièce de résistance,两个 NVIDIA Quadro RTX 8000s 共计 96GB 显存。 我们还投入了一个双端口 10GbE 卡用于测试目的,以消除数据瓶颈。 剧透警告,对于这个怪物来说仍然不够。 我们将把它与各种机器进行比较,尤其是与配备 Ryzen 9 3900X 和 NVIDIA GTX 980Ti 的系统,以及同一系统但配备单个 Quadro RTX 8000 的系统进行比较。

让我们从该工作站未指定的一件事开始,即 CPU 性能。 我们运行 Cinebench R20 并在多线程测试中获得了可观的 7169。 作为参考,消费级 AMD Ryzen 9 3900X (12c/24t) 得分为 7247,考虑到虽然 Ryzen 少了 8 个线程,但它在时钟速度上有大约 1.1GHz 的优势,不考虑 IPC 和 7nm vs 14nm 等等,这是有道理的那(这实际上是一个苹果与橘子的比较,我们为简洁起见过于简单化了)。

联想 ThinkStation P920 cinebench

这显然不是一个很好的比较,但它是 CPU 性能的一个不错的参考框架。 同样,不是针对此特定配置进行了优化; 更高的核心数和更快的时钟将大大提高 CPU 分数,并且可以作为选项使用。

好了,废话不多说,让我们来看看重点!接下来,我们运行了LuxMark 3.1,这是一个用于测试 GPU 的 OpenCL 基准测试。不出所料,P920 在这里表现出色。双 GPU 发挥了重要作用,得分比 Ryzen 系统中的单块 RTX 8000 高出一倍以上,额外的显存也是关键因素之一。

勒克斯马克
图形处理器 功能验证
P920 P4000 15,303
P920 P5000 13,170
锐龙 3900X + 980Ti 16,270
P920 RTX 5000 29,404
锐龙 3900X + RTX 8000 37,427
P920 2x RTX 8000 75,614

下一个基准测试是 SPECviewperf 13,它是基于专业应用程序的图形性能测量全球标准。SPECviewperf 13 运行 9 个基准测试,称为视图集,所有这些视图集都代表了实际应用程序中的图形内容和行为。这些视图集包括 CATIA、Creo、Energy、Maya、Medical、Showcase、Siemens NX 和 Solidworks。我们将它与 ThinkPad P72 和之前评测的 P920 工作站进行比较。您可以在这里找到有关该测试设置的更多信息。

SPECviewperf 13年
视图集 ThinkPad的P72 P920(之前的评论) P920(当前)
3dsmax-06 153.14 153.3 258.38
Catia-05 252.76 242.6 323.22
克里奥-02 222.95 214.74 329.58
能源02 35.68 22.01 72.82
玛雅-05 232.12 265.82 352.98
医疗02 55.51 68.64 148.24
展示-02 70.38 132.59 183.96
SNX-03 344.37 673.18 508.94 *
SW-04 156.88 128.86 188.57

* 这似乎是一个反常现象,尤其是与其他分数相比。 SPECworkstation的西门子NX测试,这里虽然没有列出来,但是比较符合预期。

正如预期的那样,当前 P920 的双 GPU 设置可以快速运行 SPECviewperf,尤其是与之前 P6000 评测的单 NVIDIA P920 相比。

此外,我们还运行了 SPECworkstation3,这是一个专为测试工作站性能的所有关键方面而设计的基准测试; 它使用 30 多个工作负载来测试 CPU、图形、I/O 和内存带宽。 工作负载属于更广泛的类别,例如媒体和娱乐、金融服务、产品开发、能源、生命科学和一般运营。 我们将列出每个类别的大类结果,而不是单独的工作负载。 结果是每个类别中所有单个工作负载的平均值。

SPEC工作站3
类别 ThinkPad的P72 P920(之前的评论) P920(当前)
我 1.93 2.85 3.31
产品开发 1.82 3.04 3.47
生命科学 1.61 3.23 3.62
新能源 1.18 2.07 2.14
金融 1.58 4.79 3.65
通用操作 1.46 1.79 2.06
GPU计算 2.53 3.06 6.7

在这里,ThinkStation 比 P72 更突出了台式机与移动设备的区别。 它还强调了在 GPU 计算中,这些双 RTX 8000 的重量有多大。

接下来我们将介绍Chaos Group 的 V-Ray。V -Ray 是一款 3D 渲染插件,广泛应用于建筑可视化、广告以及影视特效领域。它适用于许多常见的 3D 建模软件,但与这些软件一样,其性能也高度依赖 GPU。

联想ThinkStation P920的CPU得分为21,259,GPU得分为895。作为参考,搭载Ryzen 3900X处理器的单块RTX 8000显卡GPU得分为503,而性能较弱的980Ti显卡得分仅为303。3900X的CPU得分也相当不错,为20,368。如果您想更全面地了解这些性能分数的意义,请点击此链接查看它与其他类似系统的对比测试结果。P920在这方面表现出色。

接下来,我们将使用官方的Blender Open Data Benchmark 工具来测试一些 Blender 渲染文件。我们将使用 Cycles 引擎的 OptiX 后端对 BMW、Classroom 和 Fishy Cat 这三个演示文件进行基准测试。OptiX 后端支持 NVIDIA RTX GPU 的硬件加速光线追踪。这项功能是 Blender 2.81 版本新增的,并且仅适用于 RTX 显卡,因此我们的 980Ti 测试是基于 CUDA 的。由于基准测试工具目前不支持多 GPU 配置,因此我们在 P920 上使用完整的 Blender 应用程序进行了测试;但这不会影响测试结果。

 

搅拌机项目 锐龙 3900X + 980Ti(CUDA) 锐龙 3900X + RTX 8000 (OptiX) 联想 P920 (OptiX)
宝马 01:52.20 00:23.03 00:12.70
课堂 06:01.53 01:25.93 00:56.08
腥猫 04:12.79 00:33.67 00:32.78

除了 OptiX 后端比 CUDA 更高效之外,Quadro RTX 8000 非常适合 Blender。 P920 在这方面的表现非常出色,因为 Blender 可以很好地扩展多个 GPU,而 96GB 的 VRAM 意味着即使是大型 Blender 项目也可以及时渲染。 上面的链接提供了来自不同 GPU 的其他基准测试结果以供比较。 这次我们选择跳过 CPU 测试,因为测试配置并未针对 CPU 工作负载进行优化。 此外,值得注意的是 Fishy Cat 结果有点奇怪,因为我认为该项目并未针对多 GPU 设置进行优化,因此结果与单个 Quadro RTX 8000 相似。无论如何,这台机器对于 Blender 来说是惊人的。

最后,我们将看看 Davinci Resolve 中的一些真实用例。 这些结果将与您在 Adob​​e Premiere Pro 和 Adob​​e Media Encoder 中找到的结果类似,它们的最新版本支持 GPU 加速的 H.264 和 H.265 渲染以及在 GPU 加速效果方面的出色性能。 Davinci Resolve 的大部分内容都针对 GPU 加速进行了优化,并且原生支持多个 GPU。

这项测试旨在比较直接渲染和使用GPU密集型特效渲染的性能。直接渲染模拟了需要转码大量素材用于剪辑或样片的场景,这种情况我在日常工作中经常遇到,尤其是在处理高分辨率素材或RAW素材时。本次测试使用了三种素材:Blackmagic URSA拍摄的4.6K CinemaDNG RAW文件(可在此处直接下载)、RED Gemini拍摄的24fps 5K全画幅素材以及RED Helium拍摄的24fps 8K全画幅素材(均可在此处下载)。我们使用的特效包括水彩、浮雕(Sobel)和高斯模糊。这些文件通过10GbE网络从一台2U FreeNAS服务器传输,但正如您所看到的,即使10GbE网络带宽达到饱和,部分片段的渲染速度仍然不够快。

 

时间轴(剪辑长度) 锐龙 3900X + 980Ti 锐龙 3900X + RTX 8000 联想ThinkStation P920
室内办公室 – CinemaDNG (00:44+14f)
H.265 大师,4.6k 00:39 * 00:23 00:21
H.264 大师,1080p 01:05 00:20 00:18
效果器,H.264 1080p 02:14 01:01 00:37
外汇,H.264 4.6k N / A * 04:47 03:01
氦气 8k FF (00:22+22f)
H.265 大师,8k 00:27 * 00:32 ** 00:32 **
H.264 大师,1080p 00:22 00:13 ** 00:13 **
效果器,H.264 1080p 01:19 00:37 00:25
外汇,H.264 8k N / A * 07:41 04:34
双子座 5k FF (00:07+23f)
H.265 大师,5k 00:09 * 00:06 ** 00:06 **
H.264 大师,1080p 00:07 00:06 ** 00:06 **
效果器,H.264 1080p 00:27 00:13 00:07
外汇,H.264 5k N / A * 01:03 00:38

*980Ti (GM200) NVENC 不支持大于 4096×4096 的分辨率,即使在 H.265 中也是如此,因此母版以 UHD (3840×2160) 渲染,因此将其计入结果。 因此跳过了全分辨率 FX。

**可能是存储瓶颈,即使在 10GbE 上也是如此。

如果您发现自己经常处理 8K RED 素材,那么 96GB 的显存对于保持稳定的工作流程和在 Resolve 中保持合理的播放速度至关重要。 即使在 5K 下,双 GPU 在性能上也有明显优势。 CinemaDNG 结果虽然在 P920 上速度更快,但可能会从更快的存储中获益更多。 在最繁重的测试期间,我们从 NAS 拉取了超过 900MB/s 的速度,导致存储成为瓶颈,而 GPU 使用率在 HWinfo48 中仅看到大约 64%。 一旦我们加入 FX,我们就开始真正让 GPU 工作,并且可以看到 P920 双 GPU 设置的优势以及 Resolve 如何有效地利用它们。

结语

Lenovo ThinkStation P920 确实是机器中的野兽,但不仅如此,它还是许多不同应用程序和工作流程的出色平台。 该工作站的高度可配置特性允许满足任何需求的许多不同的可能规格。 此外,如果您的工作需求发生变化,其模块化构建允许轻松升级和重新配置。 无论您是 VFX 艺术家、CAD 设计师,还是从事 AI 和机器学习或地质模拟,都有适合您的配置。 Lenovo 提供我们作为现成解决方案测试的配置,但它们也可以按订单生产以满足您的特定需求。

联想 ThinkStations

参与 StorageReview

电子报| YouTube | 播客iTunes / Spotify | Instagram | Twitter | TikTok | RSS订阅

文斯·卡内维尔

Vincent Carnevale 是纽约的数字成像技术员,也是 IATSE Local 600 的成员。他从事的工作范围从故事片到大预算广告,再到小型公司采访,以及介于两者之间的所有工作。 Vince 拥有 SUNY New Paltz 的广播/电视制作学士学位,辅修计算机科学。