StorageReview.com

Microsoft Ignite 2024 : avancées en matière d'infrastructures personnalisées en silicium et en IA

AI  ◇  Entreprise

Microsoft a annoncé plusieurs avancées clés dans la conception de puces personnalisées et l'infrastructure d'IA lors de l'Ignite 2024. L'entreprise élargit son portefeuille de puces de silicium avec de nouvelles puces de sécurité et de traitement de données tout en renforçant son partenariat avec NVIDIA pour le calcul d'IA. Ces mises à jour visent à améliorer l'efficacité, la sécurité et les performances des services cloud de Microsoft.

La révolution du silicium personnalisé de Microsoft

Microsoft élargit considérablement son portefeuille de silicium personnalisé au-delà des accélérateurs d’IA Azure Maia et des processeurs Azure Cobalt. L’entreprise a introduit Azure Integrated HSM, une puce de sécurité interne conçue pour améliorer la gestion des clés sans compromettre les performances. En 2025, Microsoft ajoutera le module de sécurité HSM à tous les nouveaux serveurs de centre de données pour protéger les charges de travail confidentielles et à usage général.

Microsoft a également présenté Azure Boost DPU, sa première unité de traitement de données. Cette puce spécialisée gère les charges de travail centrées sur les données avec une efficacité exceptionnelle. Les nouveaux serveurs équipés de ce DPU réduiront la consommation d'énergie de deux tiers et seront quatre fois plus performants que les serveurs actuels.

Infrastructures de refroidissement et d'alimentation électrique

Microsoft a présenté son rack « sidekick » de refroidissement liquide de nouvelle génération. Cet échangeur de chaleur peut être installé ultérieurement dans les centres de données Azure pour prendre en charge les systèmes d'IA à grande échelle, notamment l'infrastructure GB200 de NVIDIA. Microsoft a également collaboré avec Meta sur une conception de rack d'alimentation désagrégée avec une alimentation CC de 400 volts, permettant jusqu'à 35 % d'accélérateurs d'IA supplémentaires dans chaque rack de serveur.

Dans le cadre d'une démarche de progrès à l'échelle de l'industrie, Microsoft ouvre le code source de ces spécifications de rack de refroidissement et d'alimentation via le projet Open Compute, permettant ainsi à l'ensemble de l'industrie de bénéficier de ces innovations.

Infrastructures informatiques et d'intelligence artificielle de nouvelle génération

L'infrastructure d'IA d'Azure continue d'évoluer avec l'introduction de la série de machines virtuelles ND H200 V5, dotée des GPU H200 de NVIDIA. La plateforme a montré des améliorations de performances remarquables, surpassant d'un facteur deux la norme de référence du secteur entre les GPU NVIDIA H100 et H200.

Microsoft a également annoncé Azure ND GB200 v6, une nouvelle série de machines virtuelles optimisées pour l'IA intégrant la conception à l'échelle du rack NVIDIA GB200 NVL 72 avec la mise en réseau Quantum InfiniBand. Cette avancée permet d'atteindre des performances de calcul intensif de l'IA à grande échelle, en connectant des dizaines de milliers de GPU Blackwell.

Pour le supercalcul basé sur le processeur, les nouvelles machines virtuelles Azure HBv5, alimentées par des processeurs AMD EPYC™ 9V64H personnalisés, promettent des performances jusqu'à huit fois plus rapides que les alternatives actuelles et seront disponibles en avant-première en 2025.

Applications de conteneurs Azure et intégration de NVIDIA

Azure Container Apps prend désormais en charge les GPU NVIDIA, ce qui permet un déploiement d’IA simplifié et évolutif. Cette plateforme de conteneurs sans serveur simplifie le déploiement et la gestion des applications basées sur des microservices en faisant abstraction de l’infrastructure sous-jacente. Grâce à la facturation à la seconde et aux fonctionnalités de mise à l’échelle à zéro, les clients ne paient que pour le calcul qu’ils utilisent, ce qui garantit une utilisation économique et efficace des ressources.

La plateforme NVIDIA AI sur Azure inclut de nouveaux workflows de référence pour l'IA industrielle et NVIDIA Omniverse Blueprint pour créer des visuels immersifs basés sur l'IA. Un workflow de référence pour la surveillance à distance 3D des opérations industrielles sera bientôt disponible, permettant aux développeurs de connecter des modèles 3D physiquement précis de systèmes industriels à des données en temps réel provenant d'Azure IoT Operations et de Power BI.

PC RTX AI et calcul avancé

NVIDIA a annoncé son nouveau SLM multimodal, NVIDIA Nemovision-4B Instruct, pour la compréhension des images visuelles dans le monde réel et à l'écran. Cette technologie, qui sera bientôt introduite sur les PC et stations de travail RTX AI, améliorera les interactions humaines numériques avec un plus grand réalisme.

Les mises à jour de NVIDIA TensorRT Model Optimizer (ModelOpt) offrent désormais aux développeurs Windows un meilleur moyen d’optimiser les modèles pour le déploiement d’ONNX Runtime. Cela permet aux développeurs de créer des modèles d’IA pour PC qui sont plus rapides et plus précis lorsqu’ils sont accélérés par les GPU RTX tout en facilitant le déploiement dans l’écosystème PC avec les runtimes ONNX.

Plus de 600 applications et jeux Windows exécutent l'IA localement sur plus de 100 millions de PC GeForce RTX AI dans le monde, offrant des performances rapides, fiables et à faible latence. La collaboration entre NVIDIA et Microsoft continue de stimuler l'innovation dans les appareils informatiques personnels, en apportant des capacités d'IA sophistiquées aux utilisateurs quotidiens.

Cloud Microsoft et infrastructure hybride

L'engagement de Microsoft en faveur des solutions multicloud et hybrides est illustré par Azure Arc, qui dessert désormais plus de 39,000 XNUMX clients dans le monde. Le nouveau Azure Local offre une infrastructure hybride sécurisée connectée au cloud avec des options flexibles, notamment des serveurs GPU pour l'inférence de l'IA.

Microsoft a également annoncé Windows Server 2025 et SQL Server 2025, qui exploitent Azure Arc pour offrir des fonctionnalités cloud dans les environnements sur site et dans le cloud. SQL Server 2025 se distingue par ses nouvelles fonctionnalités d'IA intégrées, simplifiant le développement d'applications d'IA et les modèles RAG avec prise en charge vectorielle.

Conclusion

Les innovations récentes de Microsoft soulignent son engagement à faire progresser les solutions personnalisées en matière de silicium, d'infrastructure d'IA et de cloud hybride. Avec des développements révolutionnaires tels que Azure Integrated HSM et Azure Boost DPU, Microsoft établit un nouveau modèle pour des opérations de centre de données sécurisées, efficaces et à hautes performances. L'introduction de technologies de refroidissement et d'alimentation de nouvelle génération et d'innovations open source soulignent l'engagement de Microsoft à favoriser la collaboration et la durabilité au sein du secteur.

L'évolution de l'infrastructure d'intelligence artificielle et de calcul d'Azure, notamment les machines virtuelles ND H200 V5 et ND GB200 v6, démontre la capacité de Microsoft à fournir des performances d'intelligence artificielle à grande échelle. Parallèlement, les nouvelles machines virtuelles HBv5 promettent des performances pour le calcul intensif basé sur le processeur, garantissant ainsi à Azure de rester un leader du calcul haute performance.

Enfin, grâce aux solides capacités hybrides d’Azure Arc et à l’introduction d’outils optimisés par l’IA tels que SQL Server 2025, Microsoft fournit aux entreprises des solutions flexibles et évolutives pour faire face aux complexités des charges de travail modernes. Ensemble, ces avancées consolident la position de Microsoft en tant que leader dans la conduite de l’avenir de l’IA, du cloud et de l’infrastructure hybride.

S'engager avec StorageReview

Newsletter | YouTube | Podcast iTunes / Spotify | Instagram | Twitter | TikTok | Flux RSS

Divyansh Jain

Ingénieur en apprentissage automatique, passionné de technologies et de laboratoires personnels. Chez StorageReview, je dirige les tests d'IA et de charges de travail émergentes, et je fournis des analyses de performance et des informations précieuses.