Aujourd'hui, après que NVIDIA a fait plusieurs annonces liées au GPU lors de son événement annuel GTC, Supermicro a fait ce qu'il fait de mieux, en annonçant la prise en charge matérielle de la dernière innovation à arriver sur le marché. Dans ce cas, Supermicro a annoncé avoir étendu son nouveau serveur 4U pour prendre en charge jusqu'à huit GPU NVIDIA HGX A100. La société dispose également d'un serveur 2U et prend en charge jusqu'à quatre GPU A100.
Les serveurs Supermicro pour les systèmes GPU, avec les GPU NVIDIA HGX A100, couvraient toute la gamme, y compris les systèmes GPU montés en rack 1U, 2U, 4U et 10U. Ces solutions fonctionnent de la périphérie au cloud et sont alimentées par des processeurs AMD EPYC ou Intel Xeon. Selon la société, les systèmes GPU 1U contiennent jusqu'à quatre GPU NVIDIA avec NVLink, y compris le SYS-3GQ certifié NEBS niveau 5 et compatible 1029G/Edge. Les systèmes GPU 2U de Supermicro, tels que SYS-2029GP-TR, peuvent prendre en charge jusqu'à six GPU NVIDIA V100 avec une double capacité complexe PCI-E Root dans un seul système. Et enfin, les serveurs GPU 10U, tels que SYS-9029GP-TNVRT, prennent en charge 16 extensions GPU V100 SXM3 avec des processeurs Dual Intel Xeon Scalable avec accélération AI intégrée.
Pour les nouveaux serveurs, Supermicro tire parti d'une conception thermique avancée, avec des dissipateurs thermiques personnalisés et un refroidissement liquide en option pour intégrer les cartes de base NVIDIA HGX A100 4-GPU 8-GPU, ainsi qu'un nouveau serveur 4U prenant en charge huit GPU NVIDIA A100 PCI-E. Les nouveaux serveurs utilisent le facteur de forme AIOM (Advanced I/O Module) de la société pour plus de flexibilité dans la communication réseau. AIOM fonctionne avec les périphériques de stockage et de mise en réseau PCIe gen 4 qui prennent en charge NVIDIA GPUDirect RDMA et GPUDirect Storage with NVME over Fabrics (NVMe-oF) sur NVIDIA Mellanox InfiniBand. Tout ce qui précède vise à éliminer les goulots d'étranglement dans tous les GPU.
Tout d'abord, le système 2U peut héberger jusqu'à 4 GPU NVIDIA grâce à la conception du dissipateur thermique. Ce système permet une communication peer-to-peer GPU élevée via NVIDIA NVLink, jusqu'à 8 To de mémoire système DDR4 3200 Mhz, cinq emplacements d'E/S PCI-E 4.0 prenant en charge GPUDirect RDMA ainsi que quatre NVMe remplaçables à chaud avec capacité de stockage GPUDirect. Impressionnant dans un système 2U.
Sur le plus grand système, le serveur 4U dispose de la carte de base NVIDIA HGX A100 8-GPU, jusqu'à six NVMe U.2 et deux NVMe M.2, et dix emplacements PCI-E 4.0 x16. Le système exploite les technologies AIOM, NVIDIA NVLink et NVSwitch mentionnées ci-dessus. Les cas d'utilisation de ce grand gars sont la formation d'apprentissage en profondeur à grande échelle, les applications de modèles de réseaux neuronaux pour la recherche ou les laboratoires nationaux, les clusters de supercalcul et les services cloud HPC.
Pour une densité GPU maximale, Supermicro dispose également d'un boîtier SuperBlade 8U. Ce serveur peut prendre en charge jusqu'à 20 nœuds et 40 GPU avec deux GPU simple largeur par nœud, ou un GPU NVIDIA Tensor Core A100 PCI-E par nœud. L'installation de jusqu'à 20 NVIDIA A100 dans une empreinte 8U peut en fait réduire les coûts, étant seulement 8U qui doivent être alimentés ou laissant de la place pour d'autres appareils dans les racks. Ce SuperBlade fournit une infrastructure réseau InfiniBand HDR 100 Gb/s 200 % non bloquante pour accélérer l'apprentissage en profondeur et permettre une analyse et une prise de décision en temps réel.




Amazon