StorageReview.com

Dell PowerEdge XE9680 pro generativní umělou inteligenci: Stabilní platforma, stabilní difúze, vynikající výkon

AI  ◇  Enterprise

V oblasti vysoce hodnocené podnikové umělé inteligence svádějí technologičtí titáni neúnavný závod o odhalení další významné hardwarové inovace. Společnost Dell Technologies nedávno představila server Dell PowerEdge XE9680 pro generativní umělou inteligenci a v nedávné whitepaperu jej předvádí . PowerEdge XE9680, který je speciálně navržen pro zvládání úloh umělé inteligence, není jen nováčkem v závodě – je to potenciální průkopník.

Prohrabovali jsme se v dokumentu a podívali se na to, jak tento gigant nově definuje oblast umělé inteligence a proč by mohl být tajnou zbraní vaší firmy k dobytí hranic umělé inteligence.

Dell PowerEdge XE9680 pro generativní umělou inteligenci

Dell PowerEdge XE9680 je rackový server s hustou grafickou kartou určený pro vysoce výkonné aplikace zaměřené na oblasti umělé inteligence. Je vybaven dvěma škálovatelnými procesory Intel Xeon 4. generace, každý s až 56 jádry, a může být osazen buď osmi grafickými kartami NVIDIA HGX H100, nebo osmi grafickými kartami NVIDIA HGX A100; všechny jsou propojeny technologií NVIDIA NVLink.

Dell PowerEdge XE9680 pro generativní umělou inteligenci

PowerEdge XE9680 podporuje rychlost DIMM až 4800 MT/s a má 32 slotů DDR5 DIMM s maximální kapacitou RAM 4 TB. Nabízí až 8 2.5palcových disků NVMe SSD pro ukládání dat s maximální kapacitou 122.88 TB. Server také obsahuje řadu bezpečnostních funkcí, jako je kryptograficky podepsaný firmware, šifrování Data at Rest Encryption (DRE), zabezpečené spouštění a další. Je spravován prostřednictvím integrovaného systému iDRAC9 a podporuje řadu nástrojů pro správu a integrací. Server je umístěn v rackovém provedení 6U a váží 107 kg.

Dell PowerEdge XE9680 pro generativní grafické procesory s umělou inteligencí

Specifikace serveru Dell PowerEdge XE9680

Server PowerEdge XE9680 je navržen pro práci s umělou inteligencí s masivními paměťovými nároky. Díky technologii NVLink získají grafické procesory (GPU) přístup k obrovskému množství paměti z ostatních GPU v systému, což poskytuje vysokorychlostní přístup ke sdíleným zdrojům. Tato významná paměťová kapacita by měla vést k vyššímu výkonu, složitějším modelům a schopnosti pracovat s většími a detailnějšími datovými sadami, což by mělo zlepšit přesnost a užitečnost využitím modelů s většími parametry.

Model:

  • Dell PowerEdge XE9680

Možnosti procesoru:

  • 2 zásuvky
  • Až dva škálovatelné procesory Intel Xeon 4. generace s až 56 jádry na procesor

Fyzikální vlastnosti:

  • 6U chlazené vzduchem, okolní teplota až 35 °C
  • Možnost racku 1200 mm

Podpora paměti:

  • Až 32 modulů DDR5 DIMM
  • Až 4800 MT/s (1DPC) nebo 4400 MT/s (2DPC)
I/O schopnosti:

  • 10 x 16 slotů PCIe Gen5
  • Jedna síťová karta OCP 3.0
  • 2x1GbELOM

Optimalizace GPU:

  • Grafické karty NVIDIA 8 x H100 SXM5 700W 80GB nebo NVIDIA 8 x A100 SXM4 500W 80GB
  • Plná propojitelnost NVLINK

Schopnosti umělé inteligence:

  • Trénování velkých modelů umělé inteligence

Podpora pohonu:

  • Podpora až 16 disků
  • Až 8x SAS/SATA/NVMe Gen4 nebo 16x E3.S
  • Zadní hot-plug BOSS N-1 (2 x M.2 MVNe) pro bootování (volitelné)
  • Podpora SW RAID/PERC12

Modely generování obrazu: Věda o umění

Přáli jste si někdy malovat jako Van Gogh nebo kreslit jako Da Vinci, ale nakonec byste dostali panáčky, které by neudělaly dojem ani na dítě z mateřské školy? Vstupte do světa modelů generování obrázků (IGM), což je ekvivalent strojového učení úžasného umělce, jen bez výstředností a baretů.

IGM jsou podmnožinou modelů strojového učení určených k řešení tvorby nových obrázků. IGM spadají do širší oblasti generativního modelování, které se zabývá porozuměním a replikací datových vzorů. Přesto se tyto modely místo generování čísel nebo textu zabývají tvorbou vizuální grafiky. V posledních měsících se IGM staly novinkami, které generují vše od nových uměleckých děl až po děsivě realistické lidské tváře.

Tyto modely si našly cestu do všeho od umění a zábavy až po reklamu a vědecký výzkum. Vytvářejí obrazy buněk pro lékařskou diagnostiku, simulují vesmír a generují selfie tak realistické, že si je můžete sami zachytit. S vývojem těchto modelů rostou i požadavky na jejich rychlé spouštění.

Dell PowerEdge XE9680 pro generativní umělou inteligenci: Pohon na okraji trhu, stabilní difúze

Difúzní metody při generování nových obrazů během inference obvykle závisí na masivních clusterech GPU pracujících synchronizovaně a vyžadují rozsáhlý hardwarový běh. Whitepaper společnosti Dell však odhaluje, že se serverem Dell PowerEdge XE9680 lze tyto generativní operace umělé inteligence výrazně zrychlit.

To umožňuje vytvořit desítky až stovky obrázků s rozumným rozlišením během několika sekund. Společnost Dell zdůrazňuje, že využitím možností serveru Dell PowerEdge XE9680 pro generativní umělou inteligenci lze z jediného textového řádku během několika sekund vytvořit velké obrázky s vysokým rozlišením (Dell použil 2 096 x 2 096).

Obrázky generované na serveru PowerEdge XE9680 s textovým výzvou = „Portrét šťastného psa, detail“

XE9680 generováno s textovým výzvou = „Portrét šťastného psa, detail“

Tato bílá kniha vyhodnocuje latenci generování obrázků pro model převodu textu na obrázek v nástroji HuggingFace Diffusers na serveru PowerEdge XE9680 s ohledem na velikost dávky a rozlišení obrázků. Server XE9680 dokázal generovat obrázky s rozlišením až 2 048 x 2 048.

S rostoucí velikostí dávek se zvyšovaly i paměťové nároky infrastruktury. Proto bylo možné dosáhnout obrovských dávek s obrázky s nižším rozlišením (například 256 x 256). Kvůli omezením paměti však obrázky s velmi vysokým rozlišením (například 2 048 x 2 048) mohly vygenerovat pouze dávku o velikosti jedna.

Doby dávkového generování obrazů PowerEdge XE9680

Doby dávkového generování obrazů PowerEdge XE9680

Zaměření na dávkové generování obrázků s rozlišením 256 x 256 a 512 x 512 ukazuje výkonné možnosti serveru Dell PowerEdge XE9680 pro generativní umělou inteligenci, která generuje více obrázků během několika sekund. Tato funkce urychluje vyhodnocování, rychlé ladění a další vyhodnocování potřebné pro kreativní návrhové cykly. Tyto výsledky ukazují, jak lze pomocí balíčku HuggingFace Diffusers na serveru Dell PowerEdge XE9680 generovat dávky 32 obrázků s rozlišením 512 x 512 za méně než 10 sekund. Dále lze pomocí stejné platformy vytvořit dávky 64 obrázků s rozlišením 256 x 256 za méně než 5 sekund, což umožňuje rychlé prototypování a kreativní návrhové cykly pro firmy i profesionály.

Srovnávací testy pro generování obrázků

V analýze z whitepaperu byl server Dell PowerEdge XE9680 vyhodnocen podle benchmarků latence generování obrazu stanovených společností Lambda. Toto srovnání zahrnovalo jednu grafickou kartu NVIDIA H100 s 80 GB RAM na serveru Dell PowerEdge XE9680 a benchmark NVIDIA H100 GPU Stable Diffusion, který vydal tým ML Labs ve společnosti Lambda.

Hodnoty latence dávkového generování obrazů pro server Dell PowerEdge XE9680 (modrý) i server Lambda (oranžový). Obě studie používaly jednu grafickou kartu NVIDIA® H100 s 80 GB RAM, přičemž formát GPU pro server Dell byl HGX a GPU pro server Lambda byl PCIe. Všechny obrazy používaly stejný kód HuggingFace Diffusers pro převod textu na obraz v PyTorch s textovým výzvou = „fotografie astronauta jedoucího na koni na Marsu“, počet iterací = 30, rozlišení obrazu 512 x 512, přesnost float16, plánovač DDIM, Stable Diffusion v1.4.

Latence generování obrazu Dell PowerEdge XE9680

Studie prokázala, že XE9680 překonal benchmarky Lambda a dosáhl zhruba dvojnásobné propustnosti. Zjištění společnosti Dell jsou prezentována ve stejném formátu jako zjištění společnosti Lambda, s využitím dat z jejich studie grafické karty NVIDIA H100 za identických softwarově definovaných podmínek. Jediný rozdíl byl v hardwaru: Lambda použila grafickou kartu NVIDIA H100 s formátem PCIe, zatímco server Dell PowerEdge XE9680 používal formát HGX, což by mohlo vysvětlovat některé rozdíly ve výkonu.

Dopad modelů generování obrázků na podnikání

Generování obrazu pomocí technologie Stable Diffusion umožňuje kreativním profesionálům rychle vytvářet prototypy a zdokonalovat svou práci, například zvyšovat efektivitu marketingových a reklamních strategií a zkracovat dobu uvedení produktů na trh. Tuto technologii již přijali profesionálové v oblastech, jako je architektura, reklama, marketing, kreativita, film, speciální efekty, fotografie a umění.

Generativní technologie umělé inteligence, jako je Stable Diffusion, mohou přinést transformační změny v podnikových operacích, zejména tam, kde je rychlost kritická. V oblasti návrhu a vývoje produktů mohou tyto modely rychle generovat vizuální prototypy, což umožňuje designérským týmům vyhodnocovat a zdokonalovat koncepty v reálném čase. To urychluje proces návrhu a zkracuje dobu uvedení na trh.

Jeden z nejzajímavějších konceptů pochází z maloobchodního průmyslu. Umělá inteligence by mohla rychle generovat realistické obrázky různých konfigurací produktů nebo barevných možností na základě preferencí zákazníků, například „Ukažte mi toto křeslo, ale v červené barvě“ nebo „Jak by vypadala ta pohovka s leopardím vzorem“. Pro realitní a stavební firmy by generativní umělá inteligence mohla rychle vytvářet vizualizace nových budov nebo projektů rekonstrukcí, což by pomohlo s plánováním a prodejními prezentacemi.

V oblasti školení a vzdělávání v rámci podniku lze obrázky generované umělou inteligencí použít k vytváření realistických scénářů pro školicí programy zaměstnanců, což zlepšuje výsledky učení. Rychlost generování obrázků může výrazně zlepšit agilitu podniků a umožnit jim efektivněji reagovat na změny na trhu, potřeby zákazníků a interní požadavky.

Závěrečné myšlenky

Dell PowerEdge XE9680 je vysoce výkonný server s působivými možnostmi, který snadno zvládne náročné úlohy s umělou inteligencí (alespoň prozatím). Ačkoli je XE9680 zaměřen na trendující trh s umělou inteligencí, mohl by pro tak výkonný server existovat i další zajímavé případy využití v oblasti analytiky a zpracování dat. Je třeba poznamenat, že XE9680 je základem služby Dell Project Helix , která pomáhá organizacím spustit jejich projekty v oblasti umělé inteligence online včas.

XE9680 Bílá kniha

Zapojte se do StorageReview

Zpravodaj | YouTube | Podcast iTunes / Spotify | Instagram | Twitter | TikTok | RSS kanál

Jordan Ranous

Specialista na umělou inteligenci; provede vás světem podnikové umělé inteligence. Autor a analytik pro Storage Review s praxí v oblasti analýzy velkých finančních dat, provozu/vývoje v datových centrech a analýzy zákaznické zkušenosti. Pilot, astrofotograf, guru pro LTO pásky a nadšenec pro baterie/solární energii.