Spoločnosť NVIDIA pridala konfiguráciu DGX Spark s 64 GB unifikovanou pamäťou , ktorá začína na cene 4 999 dolárov a predáva sa exkluzívne prostredníctvom spoločností Acer, ASUS, Dell, Gigabyte, HP a MSI od 23. októbra. Nová jednotka obsahuje rovnaký procesor GB10 Grace Blackwell Superchip, sieťové rozhranie ConnectX-7, operačný systém DGX a softvérový balík NVIDIA AI ako 128 GB model. NVIDIA uvádza, že 64 GB jednotka sama o sebe spúšťa modely až do 100 miliárd parametrov pre lokálnu inferenciu, jemné ladenie a pracovné postupy agentov bez odosielania údajov do cloudu.
Dva 64GB Sparky pre jeden 128GB klaster
Hlavnou výhodou lacnejšieho zariadenia (v porovnaní s trhovými cenami väčšieho modelu) je, že dva zariadenia v klastri si vedú celkom dobre. Každý DGX Spark má integrovanú sieťovú kartu ConnectX-7, takže dvojica sa pripája priamo cez kábel QSFP na 200GbE linke bez prepínača. NVIDIA Sync Cluster Assistant zabezpečuje vyhľadávanie, overuje konfiguráciu zariadenia a nastavuje sieť ConnectX-7. Dve 64GB jednotky vytvárajú 128 GB unifikovanej pamäte, čo podľa NVIDIA stačí na spustenie modelov s až 200 miliardami parametrov.
Interné čísla spoločnosti NVIDIA pre párovanie používajú Qwen3.8 27B: dva klastrované 64GB systémy poskytovali až 1.7-násobok výkonu jedného 128GB systému. Keďže každý uzol používa rovnaké knižnice CUDA, inferenčné enginy a obraz operačného systému DGX, pracovná záťaž zahŕňa obe jednotky bez nutnosti prestavby softvérového prostredia. Medzi podporované inferenčné rámce patria llama.cpp, Ollama, vLLM a LM Studio. NVIDIA má krátke video o prepojení dvoch Sparkov pomocou NVIDIA Sync.
Spustili sme distribuovaný inferenčný klaster na jednotkách Dell, Gigabyte a HP DGX Spark a nedávno sme umiestnili zdieľané úložisko za klaster Spark cez 100 GbE . SKU s kapacitou 64 GB znižuje vstupnú cenu pre tento typ konfigurácie s tou nevýhodou, že jedna jednotka teraz obsahuje polovicu pamäte ako pôvodná jednotka.
Spúšťač modelov NVIDIA Sync dorazí koncom októbra
Druhá polovica oznámenia sa týka softvéru. NVIDIA Sync Model Launcher, ktorý má byť uvedený na trh koncom októbra, stiahne a spustí model v rámci jedného Sparku alebo klastrovaného páru, napríklad Qwen3.8 27B, a výsledný koncový bod sprístupní vývojárskym počítačom v sieti. Dokáže tiež nastaviť OpenCode voči tomuto modelu, aby vývojári mohli kódovať z prehliadača, pričom klaster Spark vykonáva inferenciu.
Systémy so 64 GB RAM sa dodávajú s rovnakým softvérom ako model so 128 GB RAM: DGX OS, knižnice CUDA-X pre umelú inteligenciu, NVIDIA Agent Toolkit, otvorené modely Nemotron a runtime prostredia vrátane Ollama, vLLM a PyTorch s CUDA. NVIDIA prezentuje zariadenie ako lokálnu platformu pre agentov, inferenciu, jemné ladenie, dátovú vedu a vývoj na okraji siete a port ConnectX-7 znamená, že druhú jednotku je možné pridať neskôr. Pre tvorcov agentov NVIDIA uvádza ako východiskové body svoje playbooky pre NemoClaw, OpenClaw, Hermes Agent a OpenShell na stránke build.nvidia.com.




Amazonka