HPE a annoncé HPE AI Grid, une solution d'infrastructure complète alignée sur l' architecture de référence NVIDIA AI Grid . Elle est conçue pour connecter en toute sécurité les centres de données d'IA et les clusters d'inférence distribués sur des sites périphériques régionaux et distants. HPE positionne cette plateforme pour les fournisseurs de services qui doivent déployer et gérer des milliers de sites d'inférence distribués comme un système unique et coordonné.
HPE présente AI Grid, une solution pour les applications natives d'IA qui exigent de plus en plus une latence prévisible, des performances déterministes et un déploiement distribué. L'entreprise affirme que cette solution offre une latence ultra-faible à grande échelle, avec un provisionnement sans intervention, une orchestration intégrée et une sécurité automatisée pour simplifier la gestion du cycle de vie des déploiements de grande envergure et géographiquement dispersés.
Rami Rahim, vice-président exécutif, président et directeur général de la division Réseau chez HPE, a décrit cette stratégie comme un moyen de rapprocher l'intelligence artificielle des lieux de génération et d'utilisation des données, l'infrastructure réseau jouant un rôle clé dans les services d'IA en temps réel. Chris Penrose, vice-président mondial des télécommunications chez NVIDIA, a souligné l'importance d'une grille d'IA pour connecter des clusters géographiquement dispersés et répartir dynamiquement les charges de travail en fonction des performances, des coûts et de la latence. HPE fournit le routage multicloud et l'infrastructure de périphérie, tandis que NVIDIA propose des composants de calcul et de réseau accélérés.
Infrastructure matérielle et réseau complète
HPE affirme que HPE AI Grid offre une plateforme matérielle et logicielle unifiée conçue pour prendre en charge les modèles opérationnels des fournisseurs de services, notamment le mutualisation et la sécurité native du cloud. Son architecture repose sur les capacités HPE Juniper en matière de réseau de qualité télécom, incluant le routage multicloud et l'optique cohérente pour la connectivité longue distance et métropolitaine. HPE met également en avant les pare-feu intégrés, l'automatisation WAN et l'orchestration permettant un déploiement sans intervention et une gestion continue du cycle de vie.
Côté calcul, HPE associe des serveurs edge et rack à l'accélération matérielle NVIDIA et à une infrastructure réseau et d'E/S hautes performances. HPE prend en charge les GPU NVIDIA RTX PRO 6000 Blackwell Server Edition, ainsi que les DPU NVIDIA BlueField, les commutateurs Ethernet Spectrum-X et les cartes réseau ConnectX SuperNIC. Cette infrastructure inclut également des solutions d'IA NVIDIA pour accélérer le déploiement de services d'inférence sur des sites distribués.
focus sur le fournisseur de services
HPE positionne AI Grid pour les applications exigeant une latence prévisible et une connectivité fiable, notamment la personnalisation du commerce de détail, la maintenance prédictive, la santé en périphérie et les services d'IA de niveau opérateur. L'entreprise affirme que la plateforme permet aux opérateurs de transformer des sites disposant déjà d'une alimentation électrique et d'une connectivité en nœuds AI Grid compatibles RAN, étendant ainsi les possibilités d'inférence sans avoir à considérer chaque site comme un déploiement distinct.
Essais sur le terrain et écosystème de partenaires
Dans le cadre de sa stratégie globale d'IA Grid, Comcast a annoncé de nouveaux essais d'IA sur son réseau distribué, axés sur l'inférence en périphérie de réseau en temps réel. HPE a indiqué que les premiers essais portaient sur des serveurs HPE ProLiant exécutant de petits modèles de langage issus de Personal AI (programme partenaire Unleash AI de HPE) sur des GPU NVIDIA, pour des services d'accueil basés sur l'IA et destinés aux petites entreprises.




Amazon