Společnost NVIDIA představila nový obchodní model, který urychluje zavádění infrastruktury umělé inteligence kombinací sdílení příjmů s podporou kreditů pro poskytovatele cloudových služeb s umělou inteligencí. Iniciativa, oznámená 1. července v blogovém příspěvku, jehož spoluautorkou je finanční ředitelka Colette Kress, je navržena tak, aby rozšířila přístup k akcelerovaným výpočtům pro startupy v oblasti umělé inteligence, vývojáře modelů, podniky, výzkumné organizace a regionální poskytovatele umělé inteligence s ohledem na neustálý růst objemu produkčních inferenčních zátěží.
Toto oznámení odráží celoodvětvový posun od primárního trénování rozsáhlých jazykových modelů k provozování produkčních služeb umělé inteligence. S rostoucím zaváděním umělé inteligence se požadavky na infrastrukturu stále více zaměřují na továrny umělé inteligence, které průběžně generují inferenční tokeny ve velkém měřítku. Tato prostředí vyžadují rychle nasazitelnou infrastrukturu GPU, vysokou míru využití a architektury s více klienty, které mohou podporovat udržitelnou inferenční ekonomiku.
Rozvíjející se společnosti zabývající se umělou inteligencí se potýkají s financováním infrastruktury grafických procesorů (GPU). Kapitálové požadavky na rozsáhlé nasazení umělé inteligence často převyšují dostupné finanční prostředky, což startupům ztěžuje budování výpočetní kapacity potřebné pro produkční úlohy.
Nový model společnosti NVIDIA řeší tuto výzvu tím, že umožňuje poskytovatelům cloudových služeb s využitím umělé inteligence získat infrastrukturu NVIDIA v rámci rámce, který kombinuje sdílení příjmů s podporou úvěrů. Zúčastnění poskytovatelé budou poskytovat cloudové služby založené na technologii NVIDIA společnostem, které využívají umělou inteligenci, podnikovým zákazníkům a nezávislým dodavatelům softwaru (ISV). NVIDIA bude generovat příjmy jak z prodeje infrastruktury, tak z podílu na příjmech z cloudu spojených s podporovanou kapacitou.
Společnost očekává, že tento přístup urychlí přijetí její platformy umělé inteligence a zároveň vytvoří opakující se tok příjmů založený na užívání, který je přímo vázán na spotřebu infrastruktury.
Pro organizace, které budují základní modely, provozují inferenční služby, vyvíjejí agenty umělé inteligence nebo nasazují podnikové aplikace umělé inteligence, je tento model určen ke zkrácení doby potřebné k získání výpočetních zdrojů v produkčním měřítku. Zákazníci mohou využívat stávající cloudovou kapacitu umělé inteligence, místo aby čekali na výstavbu nového datového centra, dostupnost napájení a nasazení hardwaru.
Iniciativa se zaměřuje na poskytovatele cloudových služeb s umělou inteligencí, kteří budují továrny umělé inteligence NVIDIA DSX pro obsluhu regionálních a podnikových úloh umělé inteligence. NVIDIA označila Sharon AI a Firmus za jedny z prvních účastníků.
Společnost Sharon AI plánuje v rámci rozšíření své infrastruktury nasadit až 40 000 grafických procesorů NVIDIA Grace Blackwell GB300. Společnost Firmus buduje tovární areál DSX AI v indonéském Batamu s plány na rozšíření zařízení na 360 MW a podporu až 170 000 grafických procesorů NVIDIA.
Společnost NVIDIA také zdůraznila cloudové platformy s nativní umělou inteligencí, včetně Baseten, Fireworks AI a Together AI, jako příklady organizací, které podporují poptávku po akcelerovaném výpočetním výkonu na vyžádání. Tito poskytovatelé podporují úlohy od trénování a doladění modelů až po optimalizaci po trénování a rozsáhlou inferenci pro podnikové a vývojářské zákazníky.
Celkově tato iniciativa podtrhuje pokračující zaměření společnosti NVIDIA na rozšiřování infrastruktury umělé inteligence nad rámec prodeje hardwaru tím, že umožňuje poskytovatelům cloudových služeb poskytovat kapacitu GPU v produkčním měřítku širšímu spektru vývojářů a podniků s umělou inteligencí.




Amazon