StorageReview.com

Anuncian la GPU AMD Instinct MI100

Accesorios  ◇  Empresa

Hoy, en SC20, AMD presentó lo que proclama con audacia como el acelerador HPC más rápido del mundo para la investigación científica: el AMD Instinct MI100. Es posible que tengan razón, ya que afirman que se trata de la primera GPU para servidores x86 en superar la barrera de los 10 teraflops (FP64). La compañía combina las nuevas GPU con sus CPU AMD EPYC de segunda generación y la plataforma de software abierto ROCm 4.0 para alcanzar cifras impresionantes y ayudar a los investigadores a impulsar nuevos descubrimientos antes de la era de la exaescala.

AMD instinto MI100

Es agradable ver que la competencia se mueve hacia el espacio de GPU de gama alta. Este espacio ha sido dominado por una sola empresa durante varios años. AMD se está moviendo hacia el espacio aprovechando su nueva arquitectura AMD CDNA para la GPU AMD Instinct MI100 y luego combinándola con sus populares procesadores AMD EPYC de alto rendimiento. Se dice que esta combinación proporciona hasta 11.5 TFLOPS de rendimiento máximo de FP64 para HPC y hasta 46.1 TFLOPS de rendimiento máximo de FP32 Matrix para cargas de trabajo de inteligencia artificial y aprendizaje automático. La compañía también reclama un aumento de casi 7 veces en el rendimiento de punto flotante máximo teórico de FP16 para cargas de trabajo de entrenamiento de IA (en comparación con los aceleradores de la generación anterior de AMD) con su nueva tecnología AMD Matrix Core.

Además de las novedades de GPU, la compañía está implementando software para computación a exaescala con su último software para desarrolladores AMD ROCm. ROCm consta de compiladores, API de programación y bibliotecas que ayudan a los desarrolladores de exaescala cuando crean aplicaciones de alto rendimiento. La última versión, ROCm 4.0, está optimizada para ofrecer un alto rendimiento en sistemas basados ​​en MI100, como los marcos PyTorch y Tensorflow.

Especificaciones de AMD Instinct MI100

Calcular unidades Procesadores de flujo FP64 TFLOPS (Pico) FP32 TFLOPS (Pico) Matriz FP32 TFLOPS

(Pico)

Matriz FP16/FP16
TFLOPS (pico)
INT4 | TOPS INT8

(Pico)

bFloat16 TFLOP

(Pico)

HBM2
ECC
Salud Cerebral
ancho de banda de memoria
120 7680 Hasta 11.5 Hasta 23.1 Hasta 46.1 Hasta 184.6 Hasta 184.6 Hasta 92.3 TFLOPS 32GB Hasta 1.23 TB/s

Las capacidades y características clave del acelerador AMD Instinct MI100 incluyen:

  • Arquitectura AMD CDNA completamente nueva: diseñada para potenciar las GPU AMD para la era de la exaescala y en el corazón del acelerador MI100, la arquitectura AMD CDNA ofrece un rendimiento excepcional y eficiencia energética.
  • Rendimiento líder de FP64 y FP32 para cargas de trabajo de HPC: ofrece un rendimiento máximo de FP11.5 de 64 TFLOPS líder en la industria y un rendimiento máximo de FP23.1 de 32 TFLOPS, lo que permite a los científicos e investigadores de todo el mundo acelerar los descubrimientos en industrias que incluyen ciencias de la vida, energía, finanzas, academia, gobierno, defensa y más.
  • Tecnología Matrix Core totalmente nueva para HPC e IA: rendimiento mejorado para una gama completa de operaciones matriciales de precisión únicas y mixtas, como FP32, FP16, bFloat16, Int8 e Int4, diseñadas para impulsar la convergencia de HPC e IA.
  • Tecnología AMD Infinity Fabric de segunda generación: Instinct MI2 proporciona ~100 veces el ancho de banda máximo de E/S punto a punto (P2P) sobre PCIe 2 con hasta 4.0 GB/s de ancho de banda agregado por tarjeta con tres AMD Infinity Fabric Links. En un servidor, las GPU MI340 se pueden configurar con hasta dos subárboles de GPU cuádruples totalmente conectados, cada uno de los cuales proporciona hasta 100 GB/s de ancho de banda de E/S P552P para compartir datos rápidamente.
  • Memoria HBM2 ultrarrápida: cuenta con memoria HBM32 de ancho de banda alto de 2 GB a una velocidad de reloj de 1.2 GHz y ofrece un ancho de banda de memoria ultrarrápido de 1.23 TB/s para admitir grandes conjuntos de datos y ayudar a eliminar los cuellos de botella en el movimiento de datos dentro y fuera de la memoria .
  • Soporte para PCIe Gen 4.0 más reciente de la industria: diseñado con el soporte de tecnología PCIe Gen 4.0 más reciente que proporciona un ancho de banda de datos de transporte teórico máximo de hasta 64 GB/s desde la CPU a la GPU.

Disponibilidad

Los aceleradores AMD Instinct MI100 se esperan para finales de año en sistemas de socios OEM y ODM en los mercados empresariales, incluidos Dell, Supermicro, GIGABYTE y HPE.

AMD

Interactuar con StorageReview

Boletín informativo | YouTube | Podcast iTunes / Spotify | Instagram | Twitter | TikTok | Canal RSS

Adam Armstrong

Adam es el editor jefe de noticias de StorageReview.com y administra nuestros equipos de contenido internos y autónomos.