A Nutanix anunciou a disponibilidade geral do Nutanix Enterprise AI (NAI) 2.8, juntamente com o lançamento iminente do Nutanix Kubernetes Platform (NKP) 2.19. As atualizações têm como foco preencher a lacuna entre ambientes virtualizados legados e cargas de trabalho de IA conteinerizadas modernas. Ao implementar uma arquitetura nativa dupla, a Nutanix visa permitir que as organizações executem máquinas virtuais e aplicativos de IA conteinerizados lado a lado na infraestrutura existente , minimizando a necessidade de criar silos de infraestrutura distintos ou migrar dados por meio de camadas de rede complexas.
“A IA empresarial não deve exigir que os clientes reconstruam os sistemas que já executam seus negócios”, disse Thomas Cornely, vice-presidente executivo de gerenciamento de produtos da Nutanix. A abordagem de dupla arquitetura nativa da empresa foi projetada para manter o gerenciamento e a governança consistentes em máquinas virtuais, contêineres e frameworks de IA, permitindo a execução quase em hardware físico em sistemas virtualizados, preservando a flexibilidade arquitetônica.
Arquitetura e capacidades do Nutanix Enterprise AI 2.8
O NAI 2.8 fornece um plano de gerenciamento unificado para implantar, governar e dimensionar grandes modelos de linguagem (LLMs) e fluxos de trabalho de agentes em ambientes híbridos. O plano de controle oferece visibilidade centralizada do consumo de tokens, métricas de observabilidade integradas e funcionalidade de modelo como serviço.
Para facilitar a implementação de frameworks de IA com agentes, a plataforma introduz um Gateway de Protocolo de Contexto de Modelo (MCP) de acesso geral. Este gateway serve como uma camada de acesso padronizada para que agentes de IA interajam com ferramentas externas e conjuntos de dados corporativos sem a necessidade de engenharia personalizada. Um Servidor MCP complementar para a Plataforma de Nuvem Nutanix (NCP) também está disponível para conceder aos agentes acesso seguro e controlado aos recursos de infraestrutura gerenciados pela Nutanix.
Na área de computação e distribuição, o NAI 2.8 adiciona recursos de inferência privada e ajuste fino com múltiplas GPUs. O alto desempenho na distribuição é alcançado por meio de paralelismo de tensores em nós distribuídos, complementado por processamento em lote e decodificação especulativa. A decodificação especulativa utiliza modelos de rascunho leves para reduzir a latência de geração de tokens em até 2.5 vezes, sem afetar a precisão do modelo. Para personalização de modelos, a plataforma introduz o Ajuste Fino Eficiente de Parâmetros com Adaptação de Baixa Classificação (LoRA) para modelos com menos de 8 bilhões de parâmetros, permitindo que as organizações treinem adaptadores em dados específicos do domínio usando instâncias de GPU única e os implantem diretamente em pipelines de distribuição de produção.
Os controles de segurança do NAI foram estruturados para isolar cargas de trabalho de agentes e impedir a quebra de modelos. A plataforma impõe gerenciamento granular de identidade e acesso (IAM), controles de acesso personalizados baseados em funções, restrições de compartilhamento de modelos e suporte completo para implantações do NVIDIA NIM isoladas da internet.
Adições à Plataforma Kubernetes da Nutanix 2.19
A próxima versão do NKP, a 2.19, tem como foco a padronização das operações do Kubernetes em implantações físicas e virtualizadas. A plataforma recebeu a certificação formal CNCF de Conformidade com IA do Kubernetes, que comprova a padronização da API para orquestração de IA empresarial.
Esta versão apresenta o NKP Metal, que aplica princípios de gerenciamento de infraestrutura hiperconvergente ao Kubernetes em servidores físicos (bare-metal). Isso inclui o provisionamento automatizado de sistemas operacionais, firmware e componentes de tempo de execução de contêineres, além de armazenamento persistente nativo. Para implantações virtualizadas, o NKP Full Stack no Nutanix AHV integra-se ao Nutanix Flow para impor microsegmentação e isolamento em nível de rede, isolando assim os agentes de IA e impedindo a movimentação lateral dentro da rede.
O NKP 2.19 também adiciona um Catálogo de Aplicações de IA selecionadas para implantação automatizada de frameworks como Kubeflow, Milvus e Slurm. O gerenciamento de recursos de hardware foi atualizado com perfis de integração de GPU validados e alocação dinâmica de hardware.
Arquitetura de armazenamento e programas de parceria
A taxa de transferência de armazenamento continua sendo uma dependência crítica para a eficiência computacional sustentada da GPU. Para suportar pipelines de treinamento e inferência de alta concorrência, o Nutanix Unified Storage (NUS) obteve a certificação NVIDIA de nível empresarial. A arquitetura validada fornece caminhos de dados de baixa latência e escalonamento linear para manter os pipelines do acelerador saturados durante cargas de trabalho distribuídas.
Juntamente com as atualizações da plataforma, a Nutanix lançou o programa Powered by Nutanix: Verified Services e anunciou a disponibilidade geral do Service Provider (SP) Central. O SP Central fornece um plano de controle multilocatário que permite que provedores de serviços gerenciados provisionem, operem e monetizem serviços de infraestrutura, contêineres e IA sob modelos de licenciamento flexíveis.
O NAI 2.8 e o SP Central já estão disponíveis, e o NKP 2.19 tem previsão de lançamento em breve.




Amazon