Auf der Oracle CloudWorld-Konferenz präsentierte Oracle Cloud Infrastructure (OCI) seinen ersten OCI-Supercluster im Zettascale-Bereich, basierend auf der NVIDIA Blackwell-Plattform. Diese Lösung wurde entwickelt, um Unternehmen bei der Beschleunigung von KI-Workloads und der Datenverarbeitung zu unterstützen und nutzt dabei über 100,000 GPUs der neuesten NVIDIA-Generation. Die Supercluster bieten flexible Bereitstellungsmöglichkeiten – ob On-Premise, in öffentlichen oder souveränen Cloud-Umgebungen.
In seiner maximalen Skalierung bietet der OCI-Supercluster mehr als dreimal so viele GPUs wie der Frontier-Supercomputer und mehr als sechsmal so viele wie andere Hyperscaler. Diese Systeme können auf 131,072 Blackwell-GPUs skaliert werden und liefern 2.4 Zettaflops Spitzenleistung für KI-Rechenleistung, ermöglicht durch NVIDIA ConnectX-7-NICs und Quantum-2 InfiniBand-Netzwerke. Die auf Blackwell basierenden Systeme werden voraussichtlich in der ersten Hälfte des Jahres 2025 verfügbar sein.
NVIDIA GB200 NVL72: Flüssigkeitsgekühlte Bare-Metal-Instanzen vorgestellt
Oracle präsentierte auf der Konferenz außerdem seine flüssigkeitsgekühlten Bare-Metal-Instanzen NVIDIA GB200 NVL72 , die speziell für generative KI-Anwendungen entwickelt wurden. Diese Instanzen ermöglichen KI-Training im großen Maßstab und Echtzeit-Inferenz von Modellen mit Billionen von Parametern, indem sie über die erweiterte NVIDIA NVLink-Domäne mit 72 GPUs als eine einzige, leistungsstarke GPU fungieren. Darüber hinaus kündigte OCI die baldige Verfügbarkeit der NVIDIA HGX H200 Tensor Core GPUs an, die acht GPUs in einer einzigen Bare-Metal-Instanz verbinden können. Unternehmen können so auf bis zu 65,536 H200-GPUs skalieren. Diese Angebote sollen die Echtzeit-KI-Inferenz und das Training im großen Maßstab beschleunigen.
Einführung von NVIDIA L40S GPU-beschleunigten Instanzen
Für KI-Workloads im mittleren Bereich hat Oracle die allgemeine Verfügbarkeit von NVIDIA L40S GPU -beschleunigten Instanzen eingeführt. Die Edge-Lösungen von Oracle bieten zudem skalierbare KI-Bereitstellungen, darunter das Roving Edge Device v2, das bis zu drei NVIDIA L4 Tensor Core GPUs unterstützt, selbst an entfernten oder nicht vernetzten Standorten.
Unternehmen nutzen OCI-Supercluster bereits für KI-Innovationen. Reka, ein Foundation-Model-Startup, verwendet diese Cluster, um fortschrittliche multimodale KI-Modelle für Unternehmensagenten zu entwickeln. Laut Dani Yogatama, Mitbegründer und CEO von Reka, ermöglicht ihnen die Infrastruktur, große Modelle und Kontexte effizient zu handhaben und gleichzeitig das Training auf Clusterebene zu skalieren.
Oracle und NVIDIA präsentierten außerdem neue Integrationen zur Beschleunigung generativer KI-Workloads auf Oracle Autonomous Database. Diese Integrationen zeigen, wie NVIDIA-GPUs die KI-Funktionen in Oracle-Datenbanken verbessern können. Die Demonstrationen umfassten die Beschleunigung von Bulk-Vektoreinbettungen, die Optimierung der Vektorgraphenindexgenerierung und die Verbesserung der Textgenerierung und -übersetzung mit NVIDIA NIM-Inferenzmikroservices. Diese Innovationen ermöglichen es Unternehmen, KI nahtlos in ihr strukturiertes und unstrukturiertes Datenmanagement in Oracle-Datenbanken zu integrieren.
Adressierung der Datenresidenz
Auf globaler Ebene arbeiten Oracle und NVIDIA zusammen, um eine souveräne KI-Infrastruktur bereitzustellen, die den Anforderungen an die Datenaufbewahrung für Regierungen und Unternehmen gerecht wird. Das in Brasilien ansässige Startup Wide Labs verwendete NVIDIA H100 Tensor Core GPUs und das NeMo-Framework in den brasilianischen Rechenzentren von OCI, um Amazônia IA zu erstellen, ein großes Sprachmodell für brasilianisches Portugiesisch, das die Datensouveränität gewährleistet. In ähnlicher Weise verbessert das Nomura Research Institute in Japan seine finanzielle KI-Plattform mit LLMs und hält sich dabei an die Finanzvorschriften und Anforderungen an die Datensouveränität, indem es die Alloy-Infrastruktur von OCI mit NVIDIA-GPUs verwendet. Zoom nutzt ebenfalls NVIDIA-GPUs in den Rechenzentren von OCI in Saudi-Arabien, um die lokalen Datenschutzvorschriften einzuhalten.
Das Geomodellierungsunternehmen RSS-Hydro nutzt NVIDIA-gestützte OCI-Infrastruktur, um die Auswirkungen von Überschwemmungen in der japanischen Region Kumamoto zu simulieren. Dies zeigt, wie KI mithilfe der digitalen Zwillingstechnologie zur Eindämmung des Klimawandels eingesetzt werden kann.
Unternehmen können die Aufgabenautomatisierung auf OCI auch mithilfe von NVIDIA-Software wie NIM-Mikroservices und NVIDIA cuOpt beschleunigen. Diese Lösungen ermöglichen es Unternehmen, generative KI schnell für Aufgaben wie Codegenerierung und Routenoptimierung einzusetzen. Die AI Enterprise-Softwareplattform von NVIDIA, die diese Tools enthält, ist im Oracle Cloud Marketplace verfügbar und bietet Unternehmen leistungsstarke Ressourcen zur Verbesserung KI-gesteuerter Workflows und agentenbasierter Prozesse.




Amazon