Nutanix ha annunciato la disponibilità generale di Nutanix Enterprise AI (NAI) 2.8, in concomitanza con l'imminente rilascio di Nutanix Kubernetes Platform (NKP) 2.19. Gli aggiornamenti si concentrano sul colmare il divario tra gli ambienti virtualizzati legacy e i moderni carichi di lavoro di intelligenza artificiale containerizzati. Implementando un'architettura dual-native, Nutanix mira a consentire alle organizzazioni di eseguire macchine virtuali e applicazioni di intelligenza artificiale containerizzate in parallelo sull'infrastruttura esistente , riducendo al minimo la necessità di creare silos infrastrutturali distinti o di migrare i dati attraverso complessi livelli di rete.
"L'IA aziendale non dovrebbe obbligare i clienti a ricostruire i sistemi che già gestiscono le loro attività", ha affermato Thomas Cornely, vicepresidente esecutivo della gestione prodotti di Nutanix. L'approccio dual-native dell'azienda è progettato per mantenere una gestione e una governance coerenti tra macchine virtuali, container e framework di IA, consentendo un'esecuzione quasi bare-metal su sistemi virtualizzati, pur mantenendo la flessibilità architetturale.
Architettura e funzionalità di Nutanix Enterprise AI 2.8
NAI 2.8 offre un piano di gestione unificato per la distribuzione, la governance e la scalabilità di modelli linguistici di grandi dimensioni (LLM) e flussi di lavoro agentici in ambienti ibridi. Il piano di controllo fornisce visibilità centralizzata sul consumo di token, metriche di osservabilità integrate e funzionalità Model-as-a-Service.
Per facilitare i framework di intelligenza artificiale basati su agenti, la piattaforma introduce un gateway MCP (Model Context Protocol) disponibile a livello generale. Questo gateway funge da livello di accesso standardizzato per consentire agli agenti di IA di interfacciarsi con strumenti esterni e set di dati aziendali senza richiedere una progettazione personalizzata. È inoltre disponibile un server MCP complementare per Nutanix Cloud Platform (NCP) per garantire agli agenti un accesso sicuro e controllato alle risorse infrastrutturali gestite da Nutanix.
Sul fronte del calcolo e della distribuzione, NAI 2.8 aggiunge funzionalità di inferenza privata multi-GPU e di fine-tuning. La distribuzione ad alta velocità è ottenuta tramite il parallelismo tensoriale su nodi distribuiti, integrato dall'elaborazione batch e dalla decodifica speculativa. La decodifica speculativa utilizza modelli di bozza leggeri per ridurre la latenza di generazione dei token fino a 2.5 volte senza compromettere la precisione del modello. Per la personalizzazione del modello, la piattaforma introduce il Parameter-Efficient Fine-Tuning con Low-Rank Adaptation (LoRA) per modelli con meno di 8 miliardi di parametri, consentendo alle organizzazioni di addestrare gli adattatori su dati specifici del dominio utilizzando istanze a singola GPU e di distribuirli direttamente nelle pipeline di distribuzione in produzione.
I controlli di sicurezza all'interno di NAI sono stati strutturati per isolare i carichi di lavoro degli agenti e prevenire la violazione dei modelli. La piattaforma impone una gestione granulare delle identità e degli accessi (IAM), controlli di accesso personalizzati basati sui ruoli, restrizioni alla condivisione dei modelli e supporto completo per le implementazioni NVIDIA NIM isolate dalla rete.
Novità della versione 2.19 di Nutanix Kubernetes Platform.
La prossima release NKP 2.19 si concentra sulla standardizzazione delle operazioni di Kubernetes sia su server bare-metal che virtualizzati. La piattaforma ha ottenuto la certificazione ufficiale CNCF Certified Kubernetes AI Conformity, che attesta la standardizzazione delle API per l'orchestrazione dell'IA a livello aziendale.
Questa release introduce NKP Metal, che applica i principi di gestione dell'infrastruttura iperconvergente a Kubernetes bare-metal. Ciò include il provisioning automatizzato di sistemi operativi, firmware e componenti runtime dei container, insieme allo storage persistente nativo. Per le implementazioni virtualizzate, NKP Full Stack su Nutanix AHV si integra con Nutanix Flow per imporre la microsegmentazione e il sandboxing a livello di rete, isolando così gli agenti di intelligenza artificiale e impedendo movimenti laterali all'interno della rete.
NKP 2.19 aggiunge anche un catalogo di applicazioni AI selezionate per la distribuzione automatizzata di framework come Kubeflow, Milvus e Slurm. La gestione delle risorse hardware è stata aggiornata con profili di integrazione GPU validati e allocazione dinamica dell'hardware.
Architettura di archiviazione e programmi per i partner
La velocità di trasmissione dello storage rimane un fattore critico per garantire un'efficienza di calcolo costante delle GPU. Per supportare pipeline di training e inferenza ad alta concorrenza, Nutanix Unified Storage (NUS) ha ottenuto la certificazione NVIDIA di livello enterprise. L'architettura validata offre percorsi dati a bassa latenza e scalabilità lineare per mantenere sature le pipeline degli acceleratori durante i carichi di lavoro distribuiti.
Insieme agli aggiornamenti della piattaforma, Nutanix ha lanciato il programma Powered by Nutanix: Verified Services e ha annunciato la disponibilità generale di Service Provider (SP) Central. SP Central offre un pannello di controllo multi-tenant che consente ai fornitori di servizi gestiti di effettuare il provisioning, la gestione e la monetizzazione di servizi di infrastruttura, container e intelligenza artificiale con modelli di licenza flessibili.
NAI 2.8 e SP Central sono disponibili da subito, mentre la versione NKP 2.19 è prevista a breve.




Amazon