IBM hat eine erweiterte Zusammenarbeit mit AMD angekündigt, um AMD Instinct MI300X-Beschleuniger als Service in der IBM Cloud einzuführen. Diese Lösung verbessert die Leistung und Energieeffizienz für generative KI-Modelle (GenAI) und High-Performance-Computing-Anwendungen (HPC) und trägt damit der steigenden Nachfrage nach skalierbaren KI-Lösungen bei Unternehmenskunden Rechnung.
Die Partnerschaft erweitert die Unterstützung für AMD Instinct MI300X-Beschleuniger im gesamten KI- und Datenökosystem von IBM, einschließlich der watsonx KI-Plattform und Red Hat® Enterprise Linux® für KI-Inferenz. Dies ergänzt das bestehende Portfolio von IBM Cloud, das bereits Intel Gaudi 3- Beschleuniger umfasst und NVIDIA H100 Tensor Core GPU- Instanzen erweitert , und verbessert so die Leistungsfähigkeit für anspruchsvolle KI- und HPC-Workloads.
Erweiterte Funktionen der AMD Instinct MI300X-Beschleuniger
Die AMD Instinct MI300X-Beschleuniger, ausgestattet mit 192 GB High-Bandwidth Memory (HBM3), wurden für die Inferenz und Feinabstimmung großer Modelle in KI-Anwendungen für Unternehmen entwickelt. Dank ihrer hohen Speicherkapazität können Unternehmen größere KI-Modelle mit weniger GPUs ausführen und so Kosten senken, ohne Leistung und Skalierbarkeit einzuschränken. Wir haben diese Beschleuniger kürzlich in unserem Test des XE9680 getestet.
Indem IBM diese Beschleuniger als Service auf IBM Cloud Virtual Servers für VPC und über Containerlösungen wie den IBM Cloud Kubernetes Service und IBM Red Hat OpenShift anbietet, möchte das Unternehmen Unternehmenskunden eine sichere, leistungsstarke Umgebung bieten, die für ihre KI-Workloads optimiert ist. Diese Flexibilität ermöglicht es Unternehmen, ihre KI-Bereitstellungen effizient zu skalieren und gleichzeitig robuste Sicherheit und Compliance aufrechtzuerhalten – was besonders für Kunden in stark regulierten Branchen von entscheidender Bedeutung ist.
Integration mit IBM Watsonx- und Red Hat-Plattformen
Um den Anforderungen generativer KI-Inferenz-Workloads gerecht zu werden, plant IBM, AMD Instinct MI300X-Beschleuniger in seine watsonx-KI-Plattform zu integrieren. Dadurch erhalten watsonx-Kunden zusätzliche KI-Infrastrukturressourcen und können Workloads nahtlos über hybride Cloud-Umgebungen hinweg skalieren. Die Beschleuniger unterstützen auch die Plattformen Red Hat Enterprise Linux AI und Red Hat OpenShift AI, sodass Unternehmen große Sprachmodelle (LLMs) wie die Granite-Familie mit erweiterten Ausrichtungstools wie InstructLab bereitstellen können.
Diese Integrationen unterstreichen die Fähigkeit der Beschleuniger, rechenintensive Workloads flexibler zu bewältigen, sodass Unternehmen bei der Bereitstellung von KI Leistung, Kosteneffizienz und Skalierbarkeit priorisieren können.
Philip Guido, Executive Vice President und Chief Commercial Officer bei AMD, betonte die Bedeutung von Leistung und Flexibilität bei der Verarbeitung rechenintensiver Workloads, insbesondere wenn Unternehmen größere KI-Modelle einführen. Er wies darauf hin, dass AMD Instinct-Beschleuniger in Verbindung mit AMD ROCm-Software umfassende Ökosystemunterstützung für Plattformen wie IBM Watsonx AI und Red Hat OpenShift AI bieten, sodass Kunden GenAI-Inferenz ausführen und skalieren können, ohne Kompromisse bei Effizienz oder Kosten einzugehen.
Alan Peacock, General Manager von IBM Cloud, schloss sich dieser Meinung an und betonte die gemeinsame Vision von AMD und IBM, KI-Lösungen in Unternehmen einzuführen. Er erklärte, dass die Nutzung von AMD-Beschleunigern in der IBM Cloud Unternehmenskunden skalierbare, kostengünstige Optionen zur Erreichung ihrer KI-Ziele bietet, unterstützt durch IBMs Engagement für Sicherheit, Compliance und ergebnisorientierte Lösungen.
Zusammenarbeit bringt verbesserte Sicherheit und Compliance
Die Zusammenarbeit nutzt die bekannten Sicherheits- und Compliance-Funktionen von IBM Cloud und stellt sicher, dass Unternehmen, auch in stark regulierten Branchen, KI-Infrastrukturen mit AMD-Beschleunigern vertrauensvoll übernehmen können. Dieses Engagement für Sicherheit ist ein wesentlicher Bestandteil der Strategie von IBM und AMD, die Einführung von KI in großem Maßstab in Unternehmen zu unterstützen.
Mit dieser Zusammenarbeit bieten IBM und AMD Unternehmen eine hochmoderne KI-Infrastruktur, die Leistung, Skalierbarkeit und Effizienz in Einklang bringt. Die Ergänzung der IBM Cloud um AMD Instinct MI300X-Beschleuniger ist darauf ausgerichtet, den wachsenden Anforderungen von KI-Workloads in Unternehmen gerecht zu werden und Unternehmen neue Möglichkeiten in KI- und HPC-Anwendungen zu erschließen.
Verfügbarkeit
IBM Cloud-Dienste mit AMD Instinct MI300X-Beschleunigern werden voraussichtlich im ersten Halbjahr 2025 allgemein verfügbar sein und das Portfolio von IBM an leistungsstarken KI- und HPC-Lösungen weiter erweitern.




Amazon