StorageReview.com

Palantir och NVIDIA driftsätter en suverän Nemotron-leveranskedja, med början med de 1.3 miljoner delar som finns i varje Vera Rubin-rack

AI  ◇  Företag

Palantir och NVIDIA har byggt en suverän AI-stack för leveranskedjeoperationer och kör den först inom NVIDIAs egen leveranskedja, den som måste rada upp 1.3 miljoner delar för varje Vera Rubin-rack. Stacken inkorporerar NVIDIA Nemotron-öppna modeller i Palantir Foundry och dess plattform för artificiell intelligens (AIP), baserad på Palantir Ontology, med syftet att ge planerare insyn i hela kedjan, tidigt upptäcka begränsningar och kodifiera den operativa bedömning som hittills lever i människors huvuden. NVIDIAs implementering börjar med materialallokering, besluten om vilka delar som ska vara vart som avgör hur snabbt ett rack rör sig från wafer till första token.

Palantir- och NVIDIA-logotyper sida vid sida mot svart bakgrund

NVIDIAs leveranskedja som första kund

Ett AI-system i rackformat behöver beräknings-, minnes-, nätverks-, strömförsörjnings-, kylnings- och mekaniska delar som levereras tillsammans, till tusentals leverantörer och ett globalt tillverkningsnätverk, och NVIDIA säger att Vera Rubins leveranskedja är dubbelt så stor som Grace Blackwells. Den nya stacken ger NVIDIAs leveranskedjeteam vad företagen kallar en gemensam kommandocentral, som börjar med allokeringsbeslut, så att de kan identifiera begränsningar tidigare, utvärdera alternativ snabbare och allokera material baserat på produktionspåverkan från början till slut.

”Leveranskedjor är den fysiska ekonomins operativsystem, och AI-fabriker är bland de mest komplexa system som någonsin byggts”, säger Jensen Huang, grundare och VD för NVIDIA. ”Från wafers och komponenter till tillverkning, system och kundleveranser, hundratals företag och biljoner dollar av global ekonomisk aktivitet går samman för att leverera AI-infrastruktur.” Palantirs medgrundare och VD Alex Karp uttryckte det mer rakt på sak: ”NVIDIA har utan tvekan den mest värdefulla, invecklade och komplexa leveranskedjan i världen.” De två företagen tillkännagav först sitt operativa AI-samarbete på GTC DC i oktober förra året ; det är detta partnerskap som producerar ett driftsatt system.

Eftertränad Nemotron, cuOpt och en människa i loopen

Palantir-kunder eftertränar Nemotron och öppnar modeller på sina egna operativa data i Foundry och AIP, med hjälp av NVIDIA NeMo Data Libraries för att förbereda och utöka dem. Inom AIP hanterar NVIDIA cuOpt optimering och scenarioplanering, så att team kan modellera leveransbegränsningar, väga avvägningar och se den operativa effekten av ett allokeringsbeslut innan de fattar det. Den eftertränade modellen rekommenderar åtgärder, förklarar avvägningarna och flaggar framväxande risker, medan experterna i leveranskedjan har det slutgiltiga beslutet. Palantir Autopilot, integrerat med NeMo AutoModel- och NeMo RL-biblioteken, sluter cirkeln genom att mata varje rekommendation, planeraråtgärd och produktionsresultat tillbaka till modellförbättringen, vilket är hur företagen säger att operativ kunskap bevaras istället för att gå förlorad när människor går vidare.

NVIDIAs tekniska beskrivning av sin egen implementering ger en uppfattning om hur lätt modellarbetet är. Produktionsmodellen är Nemotron 3.5 Lightning, en modell med 30 miljarder parametrar och ungefär 3 miljarder aktiva parametrar per pass, vald framför den större Nemotron 3 Ultra för agentiska arbetsflöden. Efterträningen använde LoRA-adaptrar med frysta basvikter och färdigställdes på två B200 GPU:er på några minuter. På NVIDIAs interna benchmark för allokeringsbeslut fick den eftertränade Lightning-modellen 86.7 procents noggrannhet, 31.2 poäng före den icke-justerade Nemotron 3 Ultra och 69.2 poäng före sina egna basvikter. Det är NVIDIAs siffror baserat på NVIDIAs data, men de argumenterar för tillvägagångssättet: en liten öppen modell med organisationens egna beslut tränade in i den slår en mycket större generell modell för den organisationens problem.

Suverän genom design

Eftersom datan är NVIDIAs leveranskedja körs distributionen på NVIDIAs referensarkitekturer och den gemensamt utvecklade Palantir Sovereign AI Operating System Reference Architecture, eller SAIOS, som Dell Technologies och Cisco stöder. Egenutvecklade data, modellvikter och inferens förblir inom en enda styrd miljö, och stacken kan driftsättas lokalt hos Cisco eller Dell, eller i samlokalisering och moln med Rackspace och Nebius. Palantir och NVIDIA säger att de avser att utöka det de lär sig från NVIDIAs distribution till kunder inom jordbruk, tillverkning, läkemedel, detaljhandel, energi, sjukvård, fordonsindustrin, flyg- och rymdindustrin och myndigheter, och kommer att visa stacken och dess branschapplikationer på Palantirs AIPCon 11.

Palantir AIP

NVIDIA Nemotron

Engagera dig med StorageReview

Nyhetsbrev | YouTube | Podcast iTunes / Spotify | Instagram | Twitter | TikTok | RSS-flöde

Harold Fritts

Jag har varit i teknikbranschen sedan IBM skapade Selectric. Min bakgrund är dock att skriva. Så jag bestämde mig för att lämna pre-sales-branschen och återvända till mina rötter, skriva lite men fortfarande vara involverad i teknik.