今天,NVIDIA 宣布了一项针对 OEM 的新计划,即 NVIDIA 认证系统计划,以帮助他们踏上 AI/ML 之旅。 该计划将有助于加速利用 NVIDIA GPU(目前是大多数主要参与者)和 Mellanox 网络的系统的 AI 和数据分析。 最初的推出将涵盖 Dell Technologies、GIGABYTE、Hewlett Packard Enterprise、Inspur 和 Supermicro 等公司,这有点奇怪,因为似乎至少缺少两个主要名称。
人工智能 (AI) 可能成为下一个重大颠覆者。 在过去的几年里,它一直在慢慢获得关注。 虽然它仍处于起步阶段,但人工智能已经可以对企业进行全面的重大变革。 人工智能可用于预测、实时欺诈检测和提高自动化程度,例如可能成为下一波交通浪潮的自动驾驶汽车。 AI 真正可以发挥作用的另一个领域是大数据分析,AI 可以更快地工作以筛选每天生成的海量数据。 最重要的是,没有人知道医疗保健可以通过 AI 看到什么样的好处。
据 Gartner 称,目前有 37% 的企业正在以某种形式利用人工智能,他们预计这一比例将在三年内跃升至 75%。 新技术听起来不错,但公司可能需要某种关于如何最好地利用它的路线图。 如果要采用新技术,在将其投入数据中心之前知道它已经过“道路测试”也是件好事。 进入 NVIDIA 认证系统计划。
据该公司称,NVIDIA 认证系统可提供企业级 AI 所需的高性能、可编程性和安全吞吐量。这些系统结合了NVIDIA Ampere GPU 架构和NVIDIA Mellanox 网络(NVIDIA Mellanox 8700 HDR 200G InfiniBand 交换机或 Mellanox SN3700 以太网交换机)。NVIDIA 会运行一系列广泛的测试来认证这些系统,并针对 NGC 目录中的 AI 应用进行优化。认证测试必须涵盖深度学习训练和推理、机器学习算法、智能视频分析以及网络和存储卸载等内容。
截至撰写本文时,来自 14 家系统制造商的 70 台服务器已通过认证(至少有 11 家系统制造商的近 100 台系统参与了该计划)。 据说这些服务器拥有多达八个 AXNUMX GPU 和高速 InfiniBand 或以太网网络适配器。
首批使用 NVIDIA A100 Tensor Core GPU 的下线系统包括:
- Dell EMC PowerEdge R7525 和 R740 机架式服务器
- 技嘉R281-G30、R282-Z96、G242-Z11、G482-Z54、G492-Z51系统
- HPE Apollo 6500 Gen10 系统和 HPE ProLiant DL380 Gen10 服务器
- 浪潮NF5488A5
- Supermicro A+ 服务器 AS -4124GS-TNR 和 AS -2124GQ-NART
可用性和定价
该程序今天已启动并运行,上述服务器已准备就绪。 NVIDIA 表示定价将有等级,虽然未包含在新闻稿中,但建议配备 4 个 GPU 的服务器三年期合同的成本约为 10,000 美元。 当然,合同成本与盒子中 GPU 的数量成比例。




Amazon