IBM a récemment publié une étude montrant un intérêt croissant pour l’IA générative, même si seulement 39 % des entreprises ont commencé à l’utiliser pour l’innovation et la recherche. Cependant, ce chiffre devrait augmenter, puisque 69 % des entreprises prévoient d’utiliser l’IA générative d’ici 2025, contre seulement 29 % en 2022.
Pour répondre à la demande croissante, IBM étend son offre de calcul haute performance (HPC) en introduisant des instances de GPU NVIDIA Tensor Core sur IBM Cloud. Ces puissants GPU sont conçus pour prendre en charge les applications d'IA, notamment la formation de modèles de langage volumineux (LLM). Ce nouvel ajout rejoint les solutions informatiques existantes d'IBM Cloud, aidant les entreprises à exploiter des outils d'IA tels que Watsonx AI Studio, Data Lakehouse et la boîte à outils de gouvernance d'IBM.
S’appuyant sur ses précédentes offres de GPU NVIDIA A100 Tensor Core, IBM propose désormais les GPU NVIDIA H100, qui, selon NVIDIA, peuvent offrir des performances d’inférence jusqu’à 30 fois plus rapides. Cela offre aux clients d’IBM Cloud une plus grande puissance de traitement tout en gérant les coûts de réglage et d’inférence des modèles d’IA. Les entreprises peuvent commencer avec des modèles plus petits ou des applications d’IA comme les chatbots et la recherche en langage naturel, et à mesure que leurs besoins augmentent, elles peuvent évoluer vers des charges de travail plus exigeantes en utilisant le GPU H100.
IBM met ces GPU NVIDIA à disposition sur IBM Cloud, accessibles via le cloud privé virtuel (VPC) et les environnements Red Hat OpenShift gérés. Avec WatsonX pour la création de modèles d'IA et les outils de gestion des données et de la sécurité, les entreprises peuvent faire évoluer leurs initiatives d'IA plus facilement.
Les instances GPU NVIDIA H100 Tensor Core sont désormais disponibles dans les régions multizones (MZR) d'IBM Cloud en Amérique du Nord, en Amérique latine, en Europe, au Japon et en Australie.




Amazon