Společnost NVIDIA dnes na konferenci GPU Technology Conference 2018 v Silicon Valley oznámila několik věcí týkajících se hlubokého učení. Mezi tato oznámení patří partnerství se společností Arm s cílem zpřístupnit inferenciální technologie hlubokého učení miliardám zařízení internetu věcí. NVIDIA také oznamuje pokroky ve výkonu hlubokého učení, které jsou podle jejích slov desetkrát vyšší než před šesti měsíci.
Partnerství spočívá v integraci open-source architektury NVIDIA Deep Learning Accelerator (NVDLA) do platformy Project Trillium od společnosti ARM pro strojové učení. Společnosti uvádějí, že toto partnerství umožní výrobcům čipů pro IoT integrovat umělou inteligenci do jejich návrhů nebo ji umístit do miliard zařízení IoT. Partnerství také přinese vývojářům hlubokého učení vyšší úroveň výkonu, protože budou moci využít flexibilitu a škálovatelnost technologií Arm.
Společnost NVIDIA provedla vylepšení výkonu pro poskytovatele cloudových služeb a výrobce serverů pomocí vylepšení, jako je dvojnásobné bootování paměti s technologií NVIDIA Tesla V100 (nyní až 32 GB paměti na GPU) a propojovací struktura GPU NVSwitch, která umožňuje komunikaci až 16 GPU Tesla rychlostí 2.4 TB/s. Společnost také uvedla na trh samostatný server NVIDIA DGX-2. DGX-2 dokáže poskytnout výpočetní výkon dva petaflopy nebo 300 serverů a zabírá 15 racků.
Jak již bylo uvedeno výše, nová Tesla V100 má nyní 32 GB paměti místo 16 GB a všechny výhody, které s větší pamětí přicházejí. K tomu není moc co dodat, kromě toho, že ji v budoucnu nabídne několik výrobců počítačů. Oracle Cloud Infrastructure bude nové Tesla V100 nabízet i v cloudu.
Nová propojovací struktura NVSwitch je navržena tak, aby překonala omezení větších datových sad. NVIDIA uvádí, že tato propojovací struktura má 5x vyšší šířku pásma než nejlepší PCIe přepínač. NVSwitch využívá inovace, které pocházejí z technologie NVIDIA NVLink, a dále je rozšiřuje, což napomáhá vytváření ještě pokročilejších a komplexnějších systémů.
Jak již bylo uvedeno výše, DGX-2 dokáže dosáhnout výkonu dva petaflopy, což je světová premiéra. Systém k dosažení tohoto milníku využívá NVSwitch a všech 16 GPU v jednotném paměťovém prostoru. DGX-2 je dodáván se sadou softwaru NVIDIA pro hluboké učení, což z něj činí ideálního pro datové vědce, kteří jsou na hranici výzkumu v oblasti hlubokého učení. Společnost uvádí, že DGX-2 je schopen natrénovat FAIRSeq (nejmodernější model neuronového strojového překladu) za méně než dva dny. To je 10násobné zlepšení oproti DGX-1.




Amazon