Dell Technologies har presenterat två stora uppdateringar av sin Dell AI-plattform med AMD, riktade mot organisationer som skalar från pilotprojekt med AI till fullständiga produktionsmiljöer. Förbättringarna fokuserar på högpresterande utbildningsinfrastruktur och en modulär arkitektur som balanserar kostnad, skalbarhet och driftskontroll.
Den första uppdateringen introducerar en storskalig konfiguration med Dell PowerEdge XE9785-servernoder utrustade med AMD Instinct MI355X GPU: er och AMD EPYC-processorer. Den är utformad för krävande AI-arbetsbelastningar, inklusive modellträning, förträning och högkapacitetsinferens. Plattformen integrerar Dell PowerSwitch-nätverk och PowerScale-lagring, vilket säkerställer en konsekvent infrastrukturstack över alla distributioner.
Genom att använda AMD Instinct MI355X GPU:er ökas minneskapaciteten per nod, vilket möjliggör stöd för större modeller och effektivare skalning över kluster. Denna konfiguration riktar sig till företag och tjänsteleverantörer med kontinuerliga AI-arbetsbelastningar som kräver förutsägbar prestanda i stor skala.
Den andra förbättringen utökar Dells modulära AI Factory-arkitektur för att stödja AMD Instinct MI350P PCIe-grafikprocessorer i kombination med AMD EPYC-processorer. Denna konfiguration använder Dell PowerEdge XE7745- och R7725-servrar, PowerSwitch-nätverk och PowerScale-lagring, och integreras med Dell AI Data Platform. Den positioneras som en kostnadseffektiv väg för organisationer som går från pilotprojekt till produktion, vilket möjliggör stegvis skalning av beräknings-, minnes-, lagrings- och nätverksresurser för att åtgärda specifika flaskhalsar.
Båda konfigurationerna är byggda på AMD ROCm-programvarustacken och stöder öppna ramverk som PyTorch och vLLM. Integration med Dell Automation Platform ger distributions- och livscykelhanteringsfunktioner som förenklar klusterprovisionering och skalning.
Dell hänvisade också till resultat från en Omdia-studie som jämförde lokala driftsättningar med publika molnalternativ. Enligt rapporten kan en konfiguration med PowerEdge XE9785-servrar med AMD Instinct MI355X GPU:er ge upp till 65 % lägre total ägandekostnad, drivet av infrastruktureffektivitet och öppna programvaruekosystem.
Modulär design siktar på förutsägbar AI-skalning
Dell positionerar den uppdaterade plattformen kring en modulär design som stöder en konsekvent väg från småskalig testning till storskalig produktion. Organisationer kan börja med en konfiguration med en enda nod med så få som två GPU:er, och sedan skala upp genom att lägga till beräkningsnoder, GPU-kapacitet, lagring och nätverksbandbredd allt eftersom efterfrågan växer. Denna metod möjliggör återanvändning av initiala infrastrukturinvesteringar samtidigt som skalning sker i kontrollerade steg.
Plattformen är också utformad för flexibel arbetsbelastning. Standardisering på AMD:s AI-programvarustack för företag och öppna ramverk stöder en rad olika AI-användningsfall utan att kräva specialiserade infrastruktursilos. Detta möjliggör modellportabilitet och minskar den operativa omkostnaden för att hantera flera miljöer.
Säkerhet och styrning är fortfarande centrala för plattformens design. Genom att prioritera lokal driftsättning minskar Dell exponeringen för externa risker och bibehåller kontrollen över datalokalisering. AMD:s Enterprise AI Resource Manager tillhandahåller ytterligare styrningsfunktioner, inklusive policykontroller och åtkomsthantering, för att hjälpa organisationer att upprätthålla krav på dataskydd och efterlevnad.




Amazon