HPE a dévoilé des mises à jour de son portefeuille NVIDIA AI Computing by HPE afin de prendre en charge les centres de calcul d'IA à grande échelle et les supercalculateurs de nouvelle génération. Ces offres combinent calcul, GPU, réseau, refroidissement liquide, logiciels et services au sein de solutions complètes conçues pour les environnements à grande échelle et souverains. L'IA NVIDIA est intégrée à la plateforme de supercalcul exascale HPE . Le Laboratoire national d'Argonne, le HLRS, Hudson River Trading et l'Institut coréen d'information scientifique et technologique ont adopté l'infrastructure d'IA HPE intégrant les technologies NVIDIA pour accélérer l'innovation scientifique et industrielle.
HPE intègre les technologies NVIDIA à sa plateforme exascale de deuxième génération, le supercalculateur HPE Cray GX5000, qui réunit l'IA et le HPC au sein d'une architecture unique. Les laboratoires de recherche, les organismes publics et les entreprises combinent de plus en plus les modèles d'IA avec les simulations HPC traditionnelles, et HPE positionne sa plateforme pour répondre à ces besoins convergents.
Une nouvelle option vient enrichir la gamme : une lame de calcul HPE basée sur des processeurs NVIDIA Vera. Chaque lame de calcul HPE Cray Supercomputing GX240, refroidie par liquide, intègre jusqu’à 16 processeurs NVIDIA Vera. Un rack complet peut accueillir jusqu’à 40 lames, pour un total de 640 processeurs et 56 320 cœurs compatibles Arm. La GX240 est conçue pour les infrastructures de calcul IA haute densité et hautes performances exigeant un débit soutenu.
HPE étend également les options de mise en réseau pour les systèmes à grande échelle, en ajoutant la prise en charge de NVIDIA Quantum-X800 InfiniBand. Ces commutateurs offrent 144 ports fonctionnant à 800 Gbit/s et intègrent des fonctionnalités d'efficacité énergétique, de plus en plus importantes à l'échelle exascale.
Trish Damkroger, vice-présidente senior et directrice générale des solutions d'infrastructure HPC et IA chez HPE, a déclaré que l'expérience de l'entreprise en matière de supercalcul exascale influence sa manière d'intégrer les charges de travail d'IA avancées au HPC traditionnel. Elle a souligné que la collaboration continue avec NVIDIA permet aux clients d'atteindre une densité de performance plus élevée et de réaliser des progrès dans des domaines tels que la médecine, les sciences de la vie, l'ingénierie et la production industrielle.
Améliorations apportées à HPE AI Factory pour les déploiements à grande échelle et souverains
Au-delà de son portefeuille de supercalculateurs, HPE étend HPE AI Factory pour soutenir les fournisseurs de services, les gouvernements souverains et les grandes entreprises qui adoptent les plateformes NVIDIA Vera Rubin et NVIDIA Blackwell.
La plateforme HPE NVL72 de nouvelle génération NVIDIA Vera Rubin est la nouveauté phare. Conçue pour les modèles à grande échelle dépassant le billion de paramètres, cette plateforme rack est optimisée pour les déploiements haute performance dans les environnements néo-cloud. Elle intègre 36 processeurs NVIDIA Vera, 72 GPU NVIDIA Rubin, la technologie de mise à l'échelle NVIDIA NVLink de sixième génération, des cartes réseau NVIDIA ConnectX-9 et des DPU NVIDIA BlueField-4. HPE intègre cette plateforme à ses technologies de refroidissement liquide et à ses services de conception de centres de données afin de simplifier les déploiements à grande échelle.
HPE présente également le HPE Compute XD700, un système inspiré de l'OCP et basé sur NVIDIA HGX Rubin NVL8. Conçu pour l'entraînement et l'inférence IA à haute densité, le XD700 prend en charge jusqu'à 128 GPU Rubin par rack. Ce système double la densité de GPU de la génération précédente tout en réduisant l'encombrement, la consommation d'énergie et les besoins en refroidissement.
De plus, HPE élargit l'accès à NVIDIA Blackwell en rendant le GPU NVIDIA RTX PRO 6000 Blackwell Server Edition disponible sur tous les systèmes HPE AI Factory.
Mises à jour logicielles et de services pour un déploiement plus rapide de l'IA
Les mises à jour HPE concernent également la pile logicielle et de services qui prend en charge les environnements d'IA à grande échelle. Le portefeuille HPE AI Factory est désormais approuvé par le programme NVIDIA Cloud Partner, ce qui simplifie la certification NVIDIA Cloud Provider pour les opérateurs cloud. Il en résulte des cycles de validation plus rapides et une intégration facilitée pour les fournisseurs de services qui développent des environnements d'IA mutualisés.
HPE étend également ses options de mutualisation en prenant en charge le transfert direct des GPU des machines virtuelles et la sécurisation des espaces de noms Kubernetes grâce à NVIDIA Multi-Instance GPU (MIG). Ces fonctionnalités sont rendues possibles par l'intégration avec SUSE Virtualization et SUSE Rancher Prime, offrant ainsi aux fournisseurs le choix entre des modèles de mutualisation stricts et flexibles.
Red Hat Enterprise Linux et Red Hat OpenShift restent pris en charge dans le cadre de Red Hat AI Enterprise, s'intégrant parfaitement avec le logiciel NVIDIA AI Enterprise pour les clients qui standardisent leur utilisation sur Linux d'entreprise.
HPE AI Factory at scale et HPE AI Factory sovereign intégreront également le logiciel NVIDIA Mission Control. Mission Control fournit une couche opérationnelle unifiée pour les AI Factory, rationalisant l'orchestration via NVIDIA Run:ai et ajoutant des fonctionnalités de surveillance et de récupération autonome grâce à NVIDIA Dynamo. L'objectif est de simplifier la gestion et d'améliorer la cohérence opérationnelle pour les équipes gérant les plateformes et leurs grands clusters d'IA.
Chris Marriott, vice-président des plateformes d'entreprise chez NVIDIA, a souligné que le développement de l'IA repose sur une infrastructure robuste. Il a mis en avant la collaboration en ingénierie entre HPE et NVIDIA dans les domaines du calcul accéléré, des réseaux avancés et du refroidissement liquide, afin de permettre une analyse plus rapide des données dans le cadre de déploiements à grande échelle et souverains.
Disponibilité
Les GPU NVIDIA RTX PRO 6000 Blackwell Server Edition sont disponibles dès aujourd'hui dans la gamme HPE AI Factory. L'intégration de Red Hat Enterprise Linux et Red Hat OpenShift avec NVIDIA est également disponible dès aujourd'hui.
Les fonctionnalités multi-locataires et de transfert GPU de HPE AI Factory seront disponibles au printemps 2026. La prise en charge de NVIDIA Mission Control pour HPE AI Factory à grande échelle et de manière souveraine est prévue plus tard en 2026. Le système rack NVIDIA Vera Rubin NVL72 by HPE sera disponible en décembre 2026.
Le serveur HPE Compute XD700 sera disponible début 2027. La lame de calcul HPE Cray Supercomputing GX240, équipée de jusqu'à 16 processeurs NVIDIA Vera et d'une connectivité réseau NVIDIA Quantum-X800 InfiniBand pour le supercalculateur HPE Cray GX5000, sera également disponible en 2027.




Amazon