存储评论网

日本将数千台 NVIDIA H200 集成到 AI 桥接云基础设施 3.0 中

AI  ◇  企业版

日本即将通过将数千个 NVIDIA H200 Tensor Core GPU 集成到其 AI Bridging Cloud Infrastructure 3.0 (ABCI 3.0) 中,在 AI 研发方面取得重大进展。此次集成由日本国家先进工业科学与技术研究所 (AIST) 牵头,将使 HPE Cray XD 系统配备 NVIDIA Quantum-2 InfiniBand 网络,保证卓越的性能和可扩展性。

ABCI 3.0:推进人工智能研究与开发

ABCI 3.0 代表了日本大规模开放式 AI 计算基础设施的最新版本,旨在推动 AI 研发向前发展。这一发展凸显了日本增强 AI 能力和技术独立性的动力。自 2018 年 3.0 月推出最初的 ABCI 以来,AIST 在管理大型 AI 基础设施方面积累了丰富的经验。在此基础上,ABCI XNUMX 升级与 NVIDIA 和 HPE 合作,旨在提升日本的生成 AI 研发能力。

它将你的文化、你的社会智慧、你的常识、你的历史编入法典——你拥有自己的数据——NVIDIA 总裁兼首席执行官黄仁勋

ABCI 3.0超级计算机将位于柏。
图片由日本国家先进工业科学技术研究所提供。

ABCI 3.0 项目是 AIST、其业务子公司 AIST Solutions 和系统集成商惠普企业 (HPE) 的合作成果。该计划由日本经济产业省 (METI) 通过经济安全基金支持。它是 METI 更广泛的 1 亿美元计划的一部分,旨在加强计算资源并投资于云 AI 计算。NVIDIA 的参与意义重大,该公司承诺支持生成 AI、机器人和量子计算的研究,并投资 AI 初创公司,同时提供广泛的产品支持、培训和教育。

NVIDIA 进军日本市场

NVIDIA 与 METI 在 AI 研究和教育方面的合作是在首席执行官黄仁勋访问日本之后进行的,黄仁勋强调了“AI 工厂”——专为密集型 AI 任务设计的下一代数据中心——在将大量数据转化为可操作情报方面的关键作用。黄仁勋致力于支持日本的 AI 雄心,这与他希望 AI 工厂成为全球现代经济基石的愿景相一致。

人工智能工厂将成为全球现代经济的基石——NVIDIA 总裁兼首席执行官黄仁勋

ABCI 3.0 拥有超高密度数据中心和节能设计,将为开发人工智能和大数据应用提供强大的基础设施。该系统位于东京附近的柏市,预计将于今年年底投入运营,将提供最先进的人工智能研发资源。

无与伦比的性能和效率

ABCI 3.0 设施将提供 6 百亿亿次 AI 计算能力(衡量无稀疏性的 AI 特定性能的指标)和 410 千万亿次双精度浮点运算的通用计算能力。每个节点将通过 Quantum-2 InfiniBand 平台连接,提供 200GB/s 的对分带宽。NVIDIA 技术是该计划的核心,数百个节点配备 8 个通过 NVLink 连接的 H200 GPU,确保无与伦比的计算性能和效率。

NVIDIA H200 GPU 是一款突破性的组件,可提供超过 140 GB 的 HBM3e 内存,速度为 4.8 TB/s。NVIDIA 声称,与 ABCI 上一代 AI 工作负载平台相比,其能效提高了 15 倍。这种更大、更快的内存可显著加速生成式 AI 和大型语言模型 (LLM),从而推动高性能计算 (HPC) 工作负载的科学计算,同时提高能效并降低总拥有成本。

Quantum-2 InfiniBand 高级网络 

将 NVIDIA Quantum-2 InfiniBand 与网络内计算功能集成,可让网络设备对数据进行计算,从而减轻 CPU 的工作负担。这可确保高效、高速和低延迟的通信,这对于管理密集型 AI 工作负载和大型数据集至关重要。

ABCI 的世界级计算和数据处理能力将加速产业、学术和政府之间的联合 AI 研发工作。经济产业省对该项目的巨大投资凸显了日本增强 AI 开发能力和加速生成式 AI 使用的战略愿景。通过补贴 AI 超级计算机开发,日本旨在减少开发下一代 AI 技术所需的时间和成本,从而将自己定位为全球 AI 领域的领导者。

参与 StorageReview

资讯订阅 | YouTube | 播客 iTunes/Spotify | Instagram | Twitter(现为X) | TikTok | RSS订阅

乔丹拉努斯

人工智能专家; 引导您畅游企业人工智能的世界。 《Storage Review》的撰稿人和分析师,拥有金融大数据分析、数据中心运营/开发运营和客户体验分析背景。 飞行员、天文摄影师、LTO 磁带大师和电池/太阳能爱好者。