Nutanix ha anunciado la disponibilidad general de Nutanix Enterprise AI (NAI) 2.8 junto con el próximo lanzamiento de Nutanix Kubernetes Platform (NKP) 2.19. Estas actualizaciones se centran en cerrar la brecha entre los entornos virtualizados heredados y las cargas de trabajo de IA modernas en contenedores. Mediante la implementación de una arquitectura nativa dual, Nutanix busca permitir que las organizaciones ejecuten máquinas virtuales y aplicaciones de IA en contenedores simultáneamente en la infraestructura existente , minimizando la necesidad de crear silos de infraestructura separados o migrar datos a través de capas de red complejas.
«La IA empresarial no debería obligar a los clientes a reconstruir los sistemas que ya gestionan su negocio», afirmó Thomas Cornely, vicepresidente ejecutivo de gestión de productos de Nutanix. El enfoque de doble nativo de la compañía está diseñado para mantener una gestión y gobernanza coherentes en máquinas virtuales, contenedores y marcos de IA, lo que permite una ejecución prácticamente nativa en sistemas virtualizados, conservando al mismo tiempo la flexibilidad arquitectónica.
Arquitectura y capacidades de Nutanix Enterprise AI 2.8
NAI 2.8 proporciona un plano de gestión unificado para implementar, gobernar y escalar grandes modelos de lenguaje (LLM) y flujos de trabajo basados en agentes en entornos híbridos. El plano de control ofrece visibilidad centralizada del consumo de tokens, métricas de observabilidad integradas y funcionalidad de modelo como servicio.
Para facilitar los marcos de IA basados en agentes, la plataforma introduce una puerta de enlace del Protocolo de Contexto de Modelo (MCP) de disponibilidad general. Esta puerta de enlace funciona como una capa de acceso estandarizada para que los agentes de IA interactúen con herramientas externas y conjuntos de datos empresariales sin necesidad de ingeniería personalizada. También está disponible un servidor MCP complementario para Nutanix Cloud Platform (NCP) que otorga a los agentes acceso seguro y controlado a los recursos de infraestructura gestionados por Nutanix.
En cuanto a la computación y el servicio, NAI 2.8 añade capacidades de inferencia privada y ajuste fino multi-GPU. El servicio de alto rendimiento se logra mediante el paralelismo tensorial en nodos distribuidos, complementado con procesamiento por lotes y decodificación especulativa. La decodificación especulativa utiliza modelos borrador ligeros para reducir la latencia de generación de tokens hasta 2.5 veces sin afectar la precisión del modelo. Para la personalización de modelos, la plataforma introduce el ajuste fino eficiente de parámetros con adaptación de rango bajo (LoRA) para modelos con menos de 8 mil millones de parámetros, lo que permite a las organizaciones entrenar adaptadores con datos específicos del dominio utilizando instancias de una sola GPU e implementarlos directamente en pipelines de servicio de producción.
Los controles de seguridad de NAI se han estructurado para aislar las cargas de trabajo de los agentes y evitar fugas de modelos. La plataforma aplica una gestión de identidades y accesos (IAM) granular, controles de acceso personalizados basados en roles, restricciones para compartir modelos y compatibilidad total con implementaciones de NVIDIA NIM aisladas de la red.
Novedades de la plataforma Nutanix Kubernetes 2.19
La próxima versión NKP 2.19 se centra en la estandarización de las operaciones de Kubernetes en implementaciones tanto físicas como virtualizadas. La plataforma ha recibido la certificación oficial de la CNCF (Naval Foundation for Canada) para Kubernetes AI Conformance, que verifica la estandarización de la API para la orquestación de IA empresarial.
Esta versión presenta NKP Metal, que aplica principios de gestión de infraestructura hiperconvergente a Kubernetes en hardware físico. Esto incluye el aprovisionamiento automatizado de sistemas operativos, firmware y componentes de tiempo de ejecución de contenedores, junto con almacenamiento persistente nativo. Para implementaciones virtualizadas, NKP Full Stack en Nutanix AHV se integra con Nutanix Flow para aplicar microsegmentación y aislamiento de procesos a nivel de red, lo que permite aislar a los agentes de IA y evitar el movimiento lateral dentro de la red.
NKP 2.19 también incorpora un catálogo de aplicaciones de IA seleccionado para la implementación automatizada de marcos de trabajo como Kubeflow, Milvus y Slurm. La gestión de recursos de hardware se ha actualizado con perfiles de integración de GPU validados y asignación dinámica de hardware.
Arquitectura de almacenamiento y programas de socios
El rendimiento del almacenamiento sigue siendo un factor crítico para la eficiencia sostenida de la computación GPU. Para admitir pipelines de entrenamiento e inferencia de alta concurrencia, Nutanix Unified Storage (NUS) ha obtenido la certificación NVIDIA de nivel empresarial. La arquitectura validada proporciona rutas de datos de baja latencia y escalabilidad lineal para mantener saturados los pipelines de aceleración durante las cargas de trabajo distribuidas.
Junto con las actualizaciones de la plataforma, Nutanix lanzó el programa Powered by Nutanix: Verified Services y anunció la disponibilidad general de Service Provider (SP) Central. SP Central proporciona un plano de control multiusuario que permite a los proveedores de servicios gestionados aprovisionar, operar y monetizar servicios de infraestructura, contenedores e IA bajo modelos de licenciamiento flexibles.
NAI 2.8 y SP Central ya están disponibles, y el lanzamiento de NKP 2.19 está previsto para un futuro próximo.




Amazon