OpslagReview. com

NVIDIA en Google Cloud breiden hun AI-hypercomputerplatform uit op Next 2026.

AI  ◇  Enterprise

NVIDIA en Google Cloud hebben tijdens Google Cloud Next in Las Vegas een nieuwe fase in hun langdurige samenwerking op het gebied van engineering aangekondigd. Hierbij werden updates voor het Google Cloud AI Hypercomputer-platform gepresenteerd, waarmee agentische en fysieke AI schaalbaar worden gemaakt voor productieomgevingen. De bedrijven blijven samenwerken aan de ontwikkeling van infrastructuur, variërend van silicium en systemen tot netwerken en software, ter ondersteuning van steeds complexere AI-workloads, waaronder autonome agenten, robotica en digitale tweelingen.

NVIDIA- en Google Cloud-logo's

De op Vera Rubin gebaseerde A5X-infrastructuur richt zich op grootschalige AI-fabrieken.

Google Cloud introduceerde A5X bare-metal instances, gebouwd op NVIDIA Vera Rubin NVL72 rack-scale systemen. Deze systemen zijn ontworpen om de kosten en efficiëntie van inferentie aanzienlijk te verbeteren, met tot wel 10 keer lagere kosten per token en 10 keer hogere tokendoorvoer per megawatt dan de vorige generatie.

Het A5X-platform integreert NVIDIA ConnectX-9 SuperNIC 's met Google's Virgo-netwerkstack van de volgende generatie. Deze architectuur maakt clusteropschaling mogelijk tot 80,000 Rubin GPU's op één locatie en tot 960,000 GPU's in implementaties over meerdere locaties. Het ontwerp is gericht op hyperscale AI-trainings- en inferentieomgevingen waar netwerkprestaties en systeemoptimalisatie cruciaal zijn.

Google Cloud benadrukte dat nauw geïntegreerde infrastructuur en beheerde AI-services nodig zijn om de volgende golf van AI-workloads te ondersteunen. De gecombineerde stack stelt klanten in staat om modellen te trainen, te verfijnen en te implementeren met de nadruk op prestaties, efficiëntie en operationele schaalbaarheid.

Breed Blackwell-portfolio maakt versnelling op maat mogelijk

Google Cloud presenteerde ook zijn portfolio van op NVIDIA Blackwell gebaseerde instanties, met een breed scala aan implementatiegroottes en prestatieprofielen. Het aanbod omvat A4 VM's gebaseerd op NVIDIA HGX B200-systemen, A4X- en A4X Max-configuraties gebouwd op de GB200- en GB300 NVL72-platforms, en fractionele GPU-toegang via G4-instanties met RTX PRO 6000 Blackwell Server Edition GPU 's.

RTX PRO 6000

Dit aanbod stelt organisaties in staat hun infrastructuur af te stemmen op de werklast. Configuraties variëren van fractionele GPU's voor lichtere inferentietaken tot volledige NVL72-racks met 72 GPU's die met elkaar verbonden zijn via de vijfde generatie NVLink- en NVLink Switch-technologie. In de meest geavanceerde configuraties kunnen implementaties opschalen tot tienduizenden GPU's voor het trainen van grote modellen en gedistribueerde inferentie.

Deze systemen zijn ontworpen om een ​​reeks AI-taken te ondersteunen, waaronder mixture-of-experts (MoE)-modellen, multimodale inferentie, grootschalige gegevensverwerking en simulatietaken voor robotica en fysieke AI.

De eerste gebruikers maken al gebruik van het platform. Thinking Machines Lab gebruikt GB300 NVL72 -gebaseerde A4X Max-instances om de training voor hun Tinker API op te schalen, terwijl OpenAI grootschalige inferentieworkloads, waaronder ChatGPT, uitvoert op GB200- en GB300-gebaseerde instances in Google Cloud.

Vertrouwelijke AI-uitbreiding naar Blackwell GPU's

Google Cloud breidt de mogelijkheden voor vertrouwelijke computing uit naar zijn AI-infrastructuur. Gemini-modellen die draaien op NVIDIA Blackwell- en Blackwell Ultra-GPU's zijn nu beschikbaar als preview op Google Distributed Cloud, waardoor organisaties modellen dichter bij gevoelige gegevensbronnen kunnen implementeren.

Afbeelding van de beveiligingsinstellingen van Google Cloud

NVIDIA Confidential Computing maakt versleutelde uitvoeringsomgevingen mogelijk waarin prompts en fijnafstellingsgegevens beschermd blijven tegen ongeautoriseerde toegang, ook door cloudproviders. Deze functionaliteit komt ook beschikbaar voor multi-tenantomgevingen via Confidential G4 VM's met RTX PRO 6000 Blackwell GPU's.

Dit is de eerste implementatie van vertrouwelijke computing voor Blackwell GPU's in de publieke cloud, gericht op gereguleerde sectoren die strikte gegevensbescherming vereisen, terwijl ze tegelijkertijd toegang willen behouden tot krachtige AI-infrastructuur.

Open modellen en beheerde RL-pipelines voor agentische AI

Het platform ondersteunt een breed ecosysteem aan modellen, waaronder Google's Gemini- en Gemma-modellen en NVIDIA's open modellen van Nemotron. NVIDIA Nemotron 3 Super is nu geïntegreerd met het Gemini Enterprise Agent Platform, waardoor ontwikkelaars redeneergestuurde agentworkflows kunnen bouwen en implementeren.

Google Cloud introduceert ook Managed Training Clusters met een reinforcement learning API gebouwd op NVIDIA NeMo. Deze service automatiseert de inrichting van clusters, de orkestratie van taken en de foutafhandeling, waardoor grootschalige RL-training mogelijk wordt. Het doel is om de operationele complexiteit te verminderen en teams in staat te stellen zich te concentreren op het gedrag en de optimalisatie van modellen.

CrowdStrike gebruikt NVIDIA NeMo-tools, waaronder Data Designer, Automodel en Megatron Bridge, om synthetische data te genereren en domeinspecifieke cybersecuritymodellen te verfijnen. Deze workflows draaien op een infrastructuur gebaseerd op Blackwell, waardoor de detectie- en responsprocessen voor bedreigingen worden versneld.

Toenemende industriële en fysieke AI-werkbelasting

Het gezamenlijke platform richt zich ook op AI-toepassingen in de industrie en de fysieke industrie. Applicaties van Cadence en Siemens Digital Industries Software zijn nu beschikbaar op Google Cloud met NVIDIA-acceleratie en ondersteunen ontwerp-, simulatie- en productieprocessen in sectoren zoals de halfgeleiderindustrie, de automobielindustrie, de lucht- en ruimtevaart en de zware machinebouw.

De NVIDIA Omniverse-bibliotheken en Isaac Sim zijn beschikbaar op Google Cloud Marketplace, waardoor de ontwikkeling van fysiek accurate digitale tweelingen en robotica-simulatiepipelines mogelijk wordt. Met deze tools kunnen organisaties systemen simuleren en valideren vóór de implementatie.

Daarnaast kunnen NVIDIA NIM-microservices worden ingezet op Vertex AI en Google Kubernetes Engine ter ondersteuning van AI-visie- en robotica-workloads. Deze services maken functionaliteiten mogelijk zoals realtime videoanalyse, robotplanning en geautomatiseerde gegevensverwerking.

Platformfocus: Van experimenteren naar productie

De updates positioneren Google Cloud AI Hypercomputer als een compleet platform voor het verplaatsen van AI-workloads van onderzoek naar productie. Met nauw geïntegreerde reken-, netwerk-, software- en beveiligingsmogelijkheden is het platform ontworpen om grootschalige agentsystemen, industriële automatisering en realtime AI-toepassingen te ondersteunen.

Neem contact op met StorageReview

Nieuwsbrief | YouTube | Podcast | iTunes / Spotify | Instagram | Twitter | TikTok | RSS-feed

Harold Frits

Ik zit in de technische industrie sinds IBM Selectric heeft gemaakt. Mijn achtergrond is echter schrijven. Dus besloot ik om uit de pre-sales biz te stappen en terug te keren naar mijn roots, een beetje te schrijven maar nog steeds betrokken te zijn bij technologie.