Jensen Huang, de NVIDIA, est présent cette semaine au Computex 2023 à Taïwan. Il y a prononcé un discours d'ouverture riche en annonces de nouveaux produits, mettant l'accent sur le développement de modèles de nouvelle génération pour les applications d'IA générative, l'analyse de données et les systèmes de recommandation. Le supercalculateur NVIDIA DGX, équipé de superpuces NVIDIA GH200 Grace Hopper, et le système de commutation NVIDIA NVLink ont occupé une place centrale.
Le système NVIDIA DGX GH200 utilise la technologie d'interconnexion NVLink avec le système de commutation NVLink pour combiner 256 superpuces GH200 et fonctionner comme un seul GPU, offrant une puissance de 1 exaflops et 144 téraoctets de mémoire partagée. C'est près de 500 fois plus de mémoire qu'un système NVIDIA DGX A100 !
La technologie NVLink étend l'IA à grande échelle
Les superprocesseurs GH200 associent le processeur NVIDIA Grace basé sur l'architecture Arm au GPU NVIDIA H100 Tensor Core grâce à des interconnexions NVLink-C2C , éliminant ainsi le besoin d'une connexion PCIe traditionnelle entre le processeur et le GPU. La bande passante entre le GPU et le processeur est multipliée par sept par rapport à la technologie PCIe la plus récente, ce qui réduit la consommation d'énergie des interconnexions de plus de cinq fois et fournit un bloc de construction GPU de 600 Go basé sur l'architecture Hopper pour les supercalculateurs DGX GH200.
Il s'agit du premier supercalculateur à associer les superpuces Grace Hopper au système de commutation NVLink. Cette nouvelle interconnexion permet à tous les GPU d'un système DGX GH200 de fonctionner comme un seul, par rapport à la limite de huit GPU combinée à NVLink en tant que GPU unique sans affecter les performances. L'architecture DGX GH200 offre 10 fois plus de bande passante que la génération précédente, offrant la puissance d'un supercalculateur IA massif avec la simplicité de programmation d'un seul GPU.
Les pionniers de l'IA obtiennent de nouveaux outils de recherche
Les premiers à accéder au nouveau supercalculateur devraient être Google Cloud, Meta et Microsoft, leur permettant d'explorer ses capacités pour les charges de travail d'IA génératives. NVIDIA a l'intention de fournir la conception DGX GH200 en tant que modèle aux fournisseurs de services cloud et autres hyperscalers afin qu'ils puissent la personnaliser pour leur infrastructure.
Les chercheurs et les équipes de développement de NVIDIA auront accès au nouveau supercalculateur NVIDIA Helios doté de quatre systèmes DGX GH200. Helios comprendra 1,024 2 superpuces Grace Hopper et devrait être en ligne d'ici la fin de l'année. Chaque système du supercalculateur Helios sera interconnecté avec le réseau NVIDIA Quantum-400 InfiniBand avec un débit de données allant jusqu'à XNUMX Gb/s pour la formation de grands modèles d'IA.
Intégré et spécialement conçu
Les supercalculateurs DGX GH200 intégreront le logiciel NVIDIA, offrant une solution complète et clé en main capable de prendre en charge les charges de travail d'IA et d'analyse de données les plus importantes. Le logiciel NVIDIA Base Command assure la gestion des flux de travail d'IA, la gestion de clusters de niveau entreprise, des bibliothèques pour accélérer l'infrastructure de calcul, de stockage et de réseau, ainsi qu'un logiciel système optimisé pour l'exécution des charges de travail d'IA. Le logiciel NVIDIA AI Enterprise sera également inclus, fournissant plus de 100 frameworks, modèles réentraînés et outils de développement pour simplifier le développement et le déploiement d'IA en production, notamment l'IA générative, la vision par ordinateur, l'IA vocale et bien d'autres.
Disponibilité
Les supercalculateurs NVIDIA DGX GH200 devraient être disponibles d'ici la fin de l'année.




Amazon