NVIDIA har introducerat en ny affärsmodell för att accelerera utbyggnaden av AI-infrastruktur genom att kombinera intäktsdelning med kreditstöd för AI-molnleverantörer. Initiativet, som tillkännagavs den 1 juli i ett blogginlägg skrivet av finansdirektören Colette Kress, är utformat för att utöka tillgången till accelererad databehandling för AI-startups, modellutvecklare, företag, forskningsorganisationer och regionala AI-leverantörer i takt med att arbetsbelastningarna för produktionsinferens fortsätter att växa.
Tillkännagivandet återspeglar ett branschomfattande skifte från att främst träna stora språkmodeller till att driva AI-tjänster i produktion. I takt med att AI-användningen växer, är infrastrukturkraven alltmer centrerade mot AI-fabriker som kontinuerligt genererar inferenstokens i stor skala. Dessa miljöer kräver snabbt driftsättbar GPU-infrastruktur, höga utnyttjandegrader och arkitekturer med flera hyresgäster som kan stödja hållbar inferensekonomi.
Framväxande AI-företag har haft svårt att säkra finansiering för GPU-infrastruktur. Kapitalkraven för storskaliga AI-implementeringar överstiger ofta tillgänglig finansiering, vilket gör det svårt för nystartade företag att bygga upp den beräkningskapacitet som krävs för produktionsarbetsbelastningar.
NVIDIAs nya modell tar itu med den utmaningen genom att göra det möjligt för AI-molnleverantörer att förvärva NVIDIA-infrastruktur inom ett ramverk som kombinerar intäktsdelning med kreditstöd. Deltagande leverantörer kommer att leverera NVIDIA-baserade molntjänster till AI-baserade företag, företagskunder och oberoende programvaruleverantörer (ISV:er). NVIDIA kommer att generera intäkter genom både infrastrukturförsäljning och en andel av molnintäkterna i samband med den kapacitet som stöds.
Företaget förväntar sig att denna metod ska påskynda implementeringen av deras AI-plattform samtidigt som den skapar en återkommande, användningsbaserad intäktsström kopplad direkt till infrastrukturförbrukning.
För organisationer som bygger grundmodeller, driver inferenstjänster, utvecklar AI-agenter eller driftsätter AI-applikationer för företag är modellen avsedd att förkorta den tid som krävs för att erhålla beräkningsresurser i produktionsskala. Kunder kan utnyttja befintlig AI-molnkapacitet istället för att vänta på nybyggnation av datacenter, tillgänglighet av strömförsörjning och driftsättning av hårdvara.
Initiativet kretsar kring AI-molnleverantörer som bygger NVIDIA DSX AI-fabriker för att hantera regionala och företagsbaserade AI-arbetsbelastningar. NVIDIA identifierade Sharon AI och Firmus som bland de första deltagarna.
Sharon AI planerar att driftsätta upp till 40 000 NVIDIA Grace Blackwell GB300 GPU:er som en del av sin infrastrukturutbyggnad. Firmus utvecklar en DSX AI-fabrikscampus i Batam, Indonesien, med planer på att skala upp anläggningen till 360 MW och stödja upp till 170 000 NVIDIA GPU:er.
NVIDIA lyfte även fram AI-baserade molnplattformar, inklusive Baseten, Fireworks AI och Together AI, som exempel på organisationer som driver efterfrågan på accelererad databehandling på begäran. Dessa leverantörer stöder arbetsbelastningar som sträcker sig från modellträning och finjustering till optimering efter träning och storskalig inferens för företags- och utvecklarkunder.
Sammantaget understryker initiativet NVIDIAs fortsatta fokus på att utöka AI-infrastrukturen bortom hårdvaruförsäljning genom att göra det möjligt för molnleverantörer att leverera GPU-kapacitet i produktionsskala till ett bredare spektrum av AI-utvecklare och företag.




Amazon