StorageReview.com

HPE Cray GX5000 y AI Factory incorporan NVIDIA Vera Rubin NVL72, Quantum-X800 InfiniBand y nuevas opciones de Blackwell.

AI  ◇  Empresa

HPE ha presentado actualizaciones de su portafolio NVIDIA AI Computing by HPE para dar soporte a fábricas de IA a gran escala y supercomputadoras de próxima generación. Estas soluciones combinan computación, GPU, redes, refrigeración líquida, software y servicios en soluciones integrales diseñadas para entornos a gran escala y soberanos. NVIDIA AI se integra en la plataforma de supercomputación exaescala de HPE . El Laboratorio Nacional Argonne, HLRS, Hudson River Trading y el Instituto Coreano de Información Científica y Tecnológica han adoptado la infraestructura de HPE AI integrada con tecnologías NVIDIA para acelerar la innovación científica e industrial.

HPE Cray Discovery

HPE está integrando las tecnologías de NVIDIA en su plataforma de exaescala de segunda generación, la HPE Cray Supercomputing GX5000, que unifica la IA y la computación de alto rendimiento (HPC) en una única arquitectura. Los laboratorios de investigación, las entidades gubernamentales y las empresas combinan cada vez más modelos de IA con simulaciones HPC tradicionales, y HPE está preparando la plataforma para satisfacer estas necesidades convergentes.

Una nueva opción en la gama es un módulo de computación HPE basado en procesadores NVIDIA Vera. Cada módulo de computación HPE Cray Supercomputing GX240 con refrigeración líquida incluye hasta 16 procesadores NVIDIA Vera. Un rack completo admite hasta 40 módulos, con un total de 640 procesadores y 56 320 núcleos compatibles con Arm. El GX240 está diseñado para instalaciones de computación de IA de alta densidad y alto rendimiento que requieren un rendimiento sostenido.

HPE también está ampliando las opciones de red para sistemas a gran escala, añadiendo compatibilidad con NVIDIA Quantum-X800 InfiniBand. Estos conmutadores ofrecen 144 puertos que operan a 800 Gb/s e incorporan funciones de eficiencia energética, cada vez más importantes en la exaescala.

Trish Damkroger, vicepresidenta sénior y directora general de Soluciones de Infraestructura de HPC e IA en HPE, afirmó que la experiencia de la compañía en supercomputación a exaescala está influyendo en la forma en que integra cargas de trabajo de IA avanzadas con la computación de alto rendimiento tradicional. Destacó que la colaboración en curso con NVIDIA ayuda a los clientes a alcanzar una mayor densidad de rendimiento e impulsar el progreso en campos como la medicina, las ciencias biológicas, la ingeniería y la fabricación.

Mejoras en HPE AI Factory para implementaciones a gran escala y soberanas.

Además de su cartera de productos de supercomputación, HPE está ampliando HPE AI Factory para dar soporte a proveedores de servicios, gobiernos soberanos y grandes empresas que están adoptando las plataformas NVIDIA Vera Rubin y NVIDIA Blackwell.

La principal novedad es la nueva generación de NVIDIA Vera Rubin NVL72 de HPE. Diseñado para modelos de vanguardia con más de un billón de parámetros, este sistema de montaje en rack está optimizado para implementaciones de alta eficiencia en entornos de nueva nube. Incluye 36 CPU NVIDIA Vera, 72 GPU NVIDIA Rubin, la red escalable NVIDIA NVLink de sexta generación, tarjetas de red NVIDIA ConnectX-9 SuperNIC y unidades de procesamiento de datos NVIDIA BlueField-4. HPE integra la plataforma con sus tecnologías de refrigeración líquida y servicios de diseño de centros de datos para agilizar las implementaciones a gran escala.

HPE también presenta el HPE Compute XD700, un sistema inspirado en OCP y basado en NVIDIA HGX Rubin NVL8. El XD700 está diseñado para el entrenamiento e inferencia de IA de alta densidad, y admite hasta 128 GPU Rubin por rack. El sistema duplica la densidad de GPU de la generación anterior, a la vez que busca reducir el espacio, el consumo de energía y la refrigeración.

Además, HPE está ampliando el acceso a NVIDIA Blackwell al poner la GPU NVIDIA RTX PRO 6000 Blackwell Server Edition a disposición en todos los sistemas HPE AI Factory.

Actualizaciones de software y servicios para una implementación de IA más rápida

Las actualizaciones de HPE se extienden al conjunto de software y servicios que dan soporte a las fábricas de IA a gran escala. El portafolio de HPE AI Factory ahora cuenta con el respaldo del programa NVIDIA Cloud Partner, lo que simplifica la certificación de NVIDIA Cloud Provider para los operadores de la nube. Esto permite ciclos de validación más rápidos y una integración más sencilla para los proveedores de servicios que crean entornos de IA multiusuario.

HPE también está ampliando las opciones de multitenencia al admitir el paso directo de GPU de máquinas virtuales y espacios de nombres seguros de Kubernetes mediante NVIDIA Multi-Instance GPU (MIG). Estas capacidades se habilitan mediante la integración con SUSE Virtualization y SUSE Rancher Prime, lo que permite a los proveedores elegir entre modelos de tenencia estrictos y flexibles.

Red Hat Enterprise Linux y Red Hat OpenShift siguen recibiendo soporte como parte de Red Hat AI Enterprise, integrándose perfectamente con el software NVIDIA AI Enterprise para los clientes que estandarizan su uso con Linux empresarial.

HPE AI Factory a escala y HPE AI Factory Sovereign también integrarán el software NVIDIA Mission Control. Mission Control proporciona una capa operativa unificada para las fábricas de IA, optimizando la orquestación mediante NVIDIA Run:ai y añadiendo funciones de monitorización y recuperación autónoma de NVIDIA Dynamo. El objetivo es simplificar la gestión y mejorar la coherencia operativa para los equipos de plataforma que administran grandes clústeres de IA.

Panel de control de NVIDIA Mission Control

Chris Marriott, vicepresidente de plataformas empresariales de NVIDIA, hizo hincapié en que el desarrollo de la IA depende de una infraestructura sólida. Destacó el trabajo de ingeniería conjunto entre HPE y NVIDIA en computación acelerada, redes avanzadas y refrigeración líquida para facilitar la obtención de información más rápida en implementaciones a gran escala y soberanas.

Disponibilidad

Las GPU NVIDIA RTX PRO 6000 Blackwell Server Edition ya están disponibles en el catálogo de HPE AI Factory. La integración de Red Hat Enterprise Linux y Red Hat OpenShift con NVIDIA también está disponible desde hoy.

Las capacidades de multitenencia y de transferencia de GPU de HPE AI Factory estarán disponibles en la primavera de 2026. La compatibilidad de NVIDIA Mission Control con HPE AI Factory a gran escala y de forma autónoma está prevista para finales de 2026. El sistema NVIDIA Vera Rubin NVL72 de HPE para montaje en rack estará disponible en diciembre de 2026.

El HPE Compute XD700 estará disponible a principios de 2027. El módulo de computación HPE Cray Supercomputing GX240, con hasta 16 CPU NVIDIA Vera y conectividad de red NVIDIA Quantum-X800 InfiniBand para el HPE Cray Supercomputing GX5000, también estará disponible en 2027.

Interactuar con StorageReview

Boletín informativo | YouTube | Podcast iTunes / Spotify | Instagram | Twitter | TikTok | Canal RSS

harold fritts

He estado en la industria de la tecnología desde que IBM creó Selectric. Mi experiencia, sin embargo, es la escritura. Así que decidí dejar el negocio de preventa y volver a mis raíces, escribir un poco pero seguir involucrado en tecnología.