Společnosti NVIDIA a Google Cloud využily v Las Vegas platformu Google Cloud Next k nastínění nové fáze svého dlouhodobého inženýrského partnerství a představily aktualizace platformy Google Cloud AI Hypercomputer pro škálování agentní a fyzické umělé inteligence pro produkční prostředí. Společnosti pokračují ve společném návrhu infrastruktury zahrnující křemík, systémy, sítě a software pro podporu stále složitějších úloh umělé inteligence, včetně autonomních agentů, robotiky a digitálních dvojčat.
Infrastruktura A5X založená na platformě Vera Rubin se zaměřuje na velké továrny s umělou inteligencí
Společnost Google Cloud představila instance A5X na bázi holého kovu postavené na rackových systémech NVIDIA Vera Rubin NVL72 . Tyto systémy jsou navrženy tak, aby výrazně zlepšily ekonomiku a efektivitu inference a přinesly až 10krát nižší náklady na token a 10krát vyšší propustnost tokenů na megawatt než předchozí generace.
Platforma A5X integruje síťové karty NVIDIA ConnectX-9 SuperNIC s novou generací síťového stacku Virgo od společnosti Google. Tato architektura umožňuje škálování clusteru na 80 000 grafických procesorů Rubin v rámci jednoho webu a na 960 000 grafických procesorů v rámci více webů. Návrh se zaměřuje na hyperškálovatelná prostředí pro trénování a inferenci umělé inteligence, kde je kritický výkon sítě a optimalizace na úrovni systému.
Společnost Google Cloud zdůraznila, že pro podporu další vlny úloh umělé inteligence je nezbytná úzce integrovaná infrastruktura a spravované služby umělé inteligence. Kombinovaný stack umožňuje zákazníkům trénovat, dolaďovat a nasazovat modely s důrazem na výkon, efektivitu a provozní škálovatelnost.
Široké portfolio Blackwell umožňuje správné zrychlení
Společnost Google Cloud také představila své portfolio instancí založených na technologii NVIDIA Blackwell, které zahrnuje širokou škálu velikostí nasazení a výkonnostních profilů. Nabídka zahrnuje virtuální počítače A4 založené na systémech NVIDIA HGX B200, konfigurace A4X a A4X Max postavené na platformách GB200 a GB300 NVL72 a částečný přístup k GPU prostřednictvím instancí G4 s grafickými kartami RTX PRO 6000 Blackwell Server Edition.
Tato řada umožňuje organizacím přizpůsobit infrastrukturu požadavkům na pracovní zátěž. Konfigurace sahají od zlomkových GPU pro lehčí inferenční úlohy až po plnohodnotné racky NVL72 se 72 GPU propojenými prostřednictvím technologie NVLink a NVLink Switch páté generace. U vyšších modelů lze nasazení škálovat na desítky tisíc GPU pro trénování velkých modelů a distribuovanou inferenci.
Tyto systémy jsou navrženy tak, aby podporovaly řadu úloh umělé inteligence, včetně modelů smíšených expertů (MoE), multimodální inference, rozsáhlého zpracování dat a simulačních úloh pro robotiku a fyzickou umělou inteligenci.
První uživatelé již tuto platformu využívají. Thinking Machines Lab používá instance A4X Max založené na GB300 NVL72 k škálování školení pro své Tinker API, zatímco OpenAI spouští rozsáhlé inferenční úlohy, včetně ChatGPT, na instancích založených na GB200 a GB300 v Google Cloudu.
Důvěrná umělá inteligence se rozšiřuje i na grafické procesory Blackwell
Google Cloud rozšiřuje možnosti důvěrných výpočtů do své infrastruktury umělé inteligence. Modely Gemini běžící na grafických procesorech NVIDIA Blackwell a Blackwell Ultra jsou nyní k dispozici v náhledové verzi na platformě Google Distributed Cloud, což organizacím umožňuje nasazovat modely blíže k citlivým zdrojům dat.
Technologie NVIDIA Confidential Computing umožňuje šifrovaná prostředí pro spouštění, ve kterých jsou výzvy a dolaďovací data chráněna před neoprávněným přístupem, a to i ze strany cloudových operátorů. Tato funkce se dostává i do prostředí s více klienty prostřednictvím virtuálních počítačů Confidential G4 s grafickými kartami RTX PRO 6000 Blackwell.
Toto představuje první implementaci důvěrných výpočtů pro grafické procesory Blackwell ve veřejném cloudu, zaměřenou na regulovaná odvětví, která vyžadují přísnou ochranu dat a zároveň si zachovávají přístup k vysoce výkonné infrastruktuře umělé inteligence.
Otevřené modely a spravované RL kanály pro Agentic AI
Platforma podporuje široký ekosystém modelů, včetně modelů Gemini a Gemma od společnosti Google a otevřených modelů Nemotron od společnosti NVIDIA. NVIDIA Nemotron 3 Super je nyní integrován s platformou Gemini Enterprise Agent Platform, což vývojářům umožňuje vytvářet a nasazovat agentní pracovní postupy řízené uvažováním.
Google Cloud také představuje spravované trénovací klastry (Managed Training Clusters) s rozhraním API pro posilování učení (Renewable Learning API) postaveným na platformě NVIDIA NeMo. Tato služba automatizuje zřizování clusterů, orchestraci úloh a ošetřování chyb, což umožňuje rozsáhlé školení v učení s posilováním (RL). Cílem je snížit provozní složitost a umožnit týmům soustředit se na chování a optimalizaci modelu.
CrowdStrike využívá nástroje NVIDIA NeMo, včetně Data Designer, Automodel a Megatron Bridge, ke generování syntetických dat a doladění modelů kybernetické bezpečnosti specifických pro danou oblast. Tyto pracovní postupy běží na infrastruktuře založené na platformě Blackwell, což urychluje detekci hrozeb a reakci na ně.
Rozšiřování průmyslových a fyzických pracovních zátěží umělé inteligence
Společná platforma se zaměřuje také na průmyslové a fyzické využití umělé inteligence. Aplikace od společností Cadence a Siemens Digital Industries Software jsou nyní k dispozici na Google Cloudu s akcelerací NVIDIA a podporují pracovní postupy v oblasti návrhu, simulace a výroby napříč odvětvími, jako jsou polovodičový, automobilový, letecký a kosmický průmysl a těžká zařízení.
Knihovny NVIDIA Omniverse a Isaac Sim jsou k dispozici na Google Cloud Marketplace a umožňují vývoj fyzikálně přesných digitálních dvojčat a robotických simulačních kanálů. Tyto nástroje umožňují organizacím simulovat a validovat systémy před nasazením.
Kromě toho lze na Vertex AI a Google Kubernetes Engine nasadit mikroslužby NVIDIA NIM pro podporu úloh v oblasti vidění, umělé inteligence a robotiky. Tyto služby umožňují funkce, jako je analýza videa v reálném čase, robotické plánování a automatizované zpracování dat.
Zaměření platformy: Od experimentování k produkci
Díky těmto aktualizacím se Google Cloud AI Hypercomputer stává plnohodnotnou platformou pro přesun úloh umělé inteligence z výzkumu do produkce. Díky úzce integrovaným výpočetním, síťovým, softwarovým a bezpečnostním funkcím je platforma navržena pro podporu rozsáhlých agentních systémů, průmyslové automatizace a aplikací umělé inteligence v reálném čase.




Amazon