StorageReview.com

HPE Cray GX5000とAIファクトリーがNVIDIA Vera Rubin NVL72、Quantum-X800 InfiniBand、および新しいBlackwellオプションを導入

AI  ◇  Enterprise

HPE は、大規模 AI ファクトリーと次世代スーパーコンピュータをサポートするために、NVIDIA AI Computing by HPE ポートフォリオのアップデートを発表しました。この製品は、コンピューティング、GPU、ネットワーク、液冷、ソフトウェア、サービスを統合し、大規模かつ独立した環境向けに設計されたフルスタック ソリューションです。NVIDIA AI はHPE エクサスケール スーパーコンピューティング プラットフォームに統合されています。アルゴンヌ国立研究所、HLRS、ハドソン リバー トレーディング、韓国科学技術情報院は、科学および産業イノベーションを加速するために、NVIDIA テクノロジーを統合した HPE AI インフラストラクチャを採用しています。

HPE Cray Discovery

HPEは、NVIDIAのテクノロジーを第2世代エクサスケール級プラットフォームであるHPE Cray Supercomputing GX5000に拡張し、AIとHPCを単一のアーキテクチャに統合しました。研究機関、政府機関、企業は、AIモデルと従来のHPCシミュレーションをますます融合させており、HPEはこのプラットフォームをこうした融合するニーズに対応できるよう位置付けています。

ラインナップに新たに加わったのは、NVIDIA Vera CPUを搭載したHPEコンピュートブレードです。液冷式のHPE Cray Supercomputing GX240コンピュートブレードは、最大16個のNVIDIA Vera CPUを搭載しています。フルラックには最大40個のブレードを搭載でき、合計640個のCPUと56,320個のArm互換コアを備えています。GX240は、持続的なスループットを必要とする高密度・高性能なAIコンピューティング環境をターゲットとしています。

HPEは大規模システム向けのネットワークオプションも拡充しており、NVIDIA Quantum-X800 InfiniBandのサポートを追加しました。これらのスイッチは800Gb/sで動作する144ポートを備え、エクサスケール環境でますます重要になる電力効率機能を搭載しています。

HPEのHPCおよびAIインフラストラクチャソリューション担当上級副社長兼ゼネラルマネージャーであるトリッシュ・ダムクローガー氏は、エクサスケール・スーパーコンピューティングにおける同社の経験が、高度なAIワークロードを従来のHPCに統合する方法を形作っていると述べた。また、NVIDIAとの継続的な協業により、顧客はより高いパフォーマンス密度を実現し、医療、ライフサイエンス、エンジニアリング、製造などの分野で進歩を促進できると指摘した。

大規模展開および国家主導型展開のためのHPE AI Factoryの機能強化

HPEは、スーパーコンピューティング製品群に加え、NVIDIA Vera RubinおよびNVIDIA Blackwellプラットフォームを採用するサービスプロバイダー、各国政府、大企業を支援するため、HPE AI Factoryを拡大している。

HPEの次世代NVIDIA Vera Rubin NVL72は、今回の目玉製品です。1兆を超えるパラメータを持つ最先端規模のモデル向けに設計されたこのラックマウント型システムは、ネオクラウド環境における高効率な導入を実現します。36個のNVIDIA Vera CPU、72個のNVIDIA Rubin GPU、第6世代NVIDIA NVLinkスケールアップネットワーク、NVIDIA ConnectX-9 SuperNIC、そしてNVIDIA BlueField-4 DPUを搭載しています。HPEは、このプラットフォームを自社の液冷技術およびデータセンター設計サービスと統合することで、大規模な展開を効率化します。

HPEは、NVIDIA HGX Rubin NVL8をベースとしたOCP準拠システム「HPE Compute XD700」も発表しました。XD700は、高密度なAIトレーニングと推論向けに設計されており、ラックあたり最大128個のRubin GPUをサポートします。このシステムは、前世代のGPU密度を2倍に高めながら、設置スペース、消費電力、冷却性能の削減を目指しています。

さらに、HPEはNVIDIA RTX PRO 6000 Blackwell Server Edition GPUをすべてのHPE AI Factoryシステムで利用可能にすることで、NVIDIA Blackwellへのアクセスを拡大します。

AI導入を加速するためのソフトウェアおよびサービスのアップデート

HPEのアップデートは、大規模AIファクトリーを支えるソフトウェアおよびサービススタックにも及んでいます。HPE AIファクトリーポートフォリオは、NVIDIAクラウドパートナープログラムの認定を受け、クラウド事業者向けのNVIDIAクラウドプロバイダー認証が簡素化されました。これにより、マルチテナントAI環境を構築するサービスプロバイダーは、検証サイクルの短縮と統合の容易化を実現できます。

HPEは、NVIDIAマルチインスタンスGPU(MIG)を使用した仮想マシンGPUパススルーとセキュアなKubernetesネームスペースのサポートにより、マルチテナントオプションも拡張しています。これらの機能は、SUSE VirtualizationおよびSUSE Rancher Primeとの統合によって実現され、プロバイダーは厳格なテナントモデルと柔軟なテナントモデルを選択できるようになります。

Red Hat Enterprise LinuxとRed Hat OpenShiftは、Red Hat AI Enterpriseの一部として引き続きサポートされ、エンタープライズLinuxを標準採用する顧客向けにNVIDIA AI Enterpriseソフトウェアとスムーズに統合されます。

HPE AI Factory at scaleおよびHPE AI Factory sovereignは、NVIDIA Mission Controlソフトウェアも統合します。Mission Controlは、AIファクトリー向けに統一された運用レイヤーを提供し、NVIDIA Run:aiによるオーケストレーションを効率化するとともに、NVIDIA Dynamoによる監視機能と自律的な復旧機能を追加します。これにより、大規模なAIクラスターを運用するプラットフォームチームの管理を簡素化し、運用の一貫性を向上させることを目的としています。

NVIDIA Mission Control ダッシュボード

NVIDIAのエンタープライズプラットフォーム担当副社長であるクリス・マリオット氏は、AI開発は堅牢なインフラストラクチャに依存すると強調した。同氏は、大規模かつ独立した展開において、より迅速な洞察を可能にするため、HPEとNVIDIAが共同で取り組んでいる高速コンピューティング、高度なネットワーク、および液冷技術について言及した。

利用状況

NVIDIA RTX PRO 6000 Blackwell Server Edition GPUは、本日よりHPE AI Factory製品ラインナップに加わりました。また、Red Hat Enterprise LinuxおよびRed Hat OpenShiftとNVIDIAの統合も本日よりご利用いただけます。

HPE AI Factoryのマルチテナント機能とGPUパススルー機能は、2026年春に提供開始予定です。NVIDIA Mission ControlによるHPE AI Factoryの大規模かつ独立した運用サポートは、2026年後半に提供開始予定です。HPE製ラックマウント型システム「NVIDIA Vera Rubin NVL72」は、2026年12月に提供開始予定です。

HPE Compute XD700は2027年初頭に発売予定です。また、最大16個のNVIDIA Vera CPUとNVIDIA Quantum-X800 InfiniBandネットワークを搭載したHPE Cray Supercomputing GX5000向けHPE Cray Supercomputing GX240 Computeブレードも2027年に発売予定です。

StorageReview と連携する

ニュースレター| YouTube | ポッドキャスト(iTunes / Spotify) | Instagram | Twitter | TikTok | RSSフィード

ハロルド・フリッツ

IBM が Selectric を設立して以来、私はテクノロジー業界に携わってきました。しかし、私のバックグラウンドは執筆です。そこで私はプリセールスの仕事から抜け出し、自分のルーツに戻り、少し執筆活動をしながらもテクノロジーに携わることにしました。