Nutanix annonce la disponibilité générale de Nutanix Enterprise AI (NAI) 2.8 et la sortie prochaine de Nutanix Kubernetes Platform (NKP) 2.19. Ces mises à jour visent à faciliter la transition entre les environnements virtualisés traditionnels et les charges de travail d'IA conteneurisées modernes. Grâce à une architecture double native, Nutanix permet aux entreprises d'exécuter simultanément des machines virtuelles et des applications d'IA conteneurisées sur leur infrastructure existante , minimisant ainsi la nécessité de créer des silos d'infrastructure distincts ou de migrer des données à travers des couches réseau complexes.
« L’IA d’entreprise ne devrait pas obliger les clients à reconstruire les systèmes qui gèrent déjà leur activité », a déclaré Thomas Cornely, vice-président exécutif de la gestion des produits chez Nutanix. L’approche à double architecture native de l’entreprise est conçue pour garantir une gestion et une gouvernance cohérentes des machines virtuelles, des conteneurs et des frameworks d’IA, permettant une exécution quasi-physique sur les systèmes virtualisés tout en préservant la flexibilité architecturale.
Architecture et fonctionnalités de Nutanix Enterprise AI 2.8
NAI 2.8 offre une plateforme de gestion unifiée pour le déploiement, la gouvernance et la mise à l'échelle des grands modèles de langage (LLM) et des flux de travail multi-agents dans des environnements hybrides. Cette plateforme centralise la visibilité sur la consommation de jetons, intègre des indicateurs d'observabilité et propose des fonctionnalités de modèle en tant que service (MaaS).
Pour faciliter le déploiement de frameworks d'IA multi-agents, la plateforme introduit une passerelle MCP (Model Context Protocol) disponible pour tous. Cette passerelle sert de couche d'accès standardisée permettant aux agents d'IA d'interagir avec des outils externes et des ensembles de données d'entreprise sans nécessiter de développement spécifique. Un serveur MCP associé pour Nutanix Cloud Platform (NCP) est également disponible afin d'offrir aux agents un accès sécurisé et contrôlé aux ressources d'infrastructure gérées par Nutanix.
Côté calcul et diffusion, NAI 2.8 intègre l'inférence privée multi-GPU et des capacités d'ajustement fin. Le haut débit est assuré par le parallélisme tensoriel sur des nœuds distribués, complété par le traitement par lots et le décodage spéculatif. Ce dernier utilise des modèles brouillons légers pour réduire la latence de génération des jetons jusqu'à 2.5 fois sans impacter la précision du modèle. Pour la personnalisation des modèles, la plateforme introduit l'ajustement fin optimisé des paramètres avec adaptation à faible rang (LoRA) pour les modèles de moins de 8 milliards de paramètres. Les entreprises peuvent ainsi entraîner des adaptateurs sur des données spécifiques à leur domaine à l'aide d'instances mono-GPU et les déployer directement dans leurs pipelines de production.
Les contrôles de sécurité de NAI sont conçus pour isoler les charges de travail des agents et empêcher toute fuite de modèles. La plateforme applique une gestion granulaire des identités et des accès (IAM), des contrôles d'accès personnalisés basés sur les rôles, des restrictions de partage de modèles et une prise en charge complète des déploiements NVIDIA NIM isolés du réseau.
Ajouts à la plateforme Nutanix Kubernetes 2.19
La prochaine version NKP 2.19 vise à standardiser les opérations Kubernetes sur les déploiements physiques et virtualisés. La plateforme a obtenu la certification CNCF Certified Kubernetes AI Conformance, attestant de la standardisation des API pour l'orchestration de l'IA en entreprise.
Cette version introduit NKP Metal, qui applique les principes de gestion d'infrastructure hyperconvergée aux environnements Kubernetes physiques. Elle inclut le provisionnement automatisé des systèmes d'exploitation, des firmwares et des composants d'exécution des conteneurs, ainsi qu'un stockage persistant natif. Pour les déploiements virtualisés, NKP Full Stack sur Nutanix AHV s'intègre à Nutanix Flow afin de garantir la microsegmentation et le sandboxing au niveau du réseau, isolant ainsi les agents d'IA et empêchant les déplacements latéraux au sein du réseau.
NKP 2.19 intègre également un catalogue d'applications d'IA pour le déploiement automatisé de frameworks tels que Kubeflow, Milvus et Slurm. La gestion des ressources matérielles a été mise à jour avec des profils d'intégration GPU validés et une allocation matérielle dynamique.
Architecture de stockage et programmes partenaires
Le débit de stockage demeure un facteur essentiel pour une efficacité de calcul GPU durable. Afin de prendre en charge les pipelines d'entraînement et d'inférence à haute concurrence, Nutanix Unified Storage (NUS) a obtenu la certification NVIDIA de niveau entreprise. Son architecture validée offre des chemins de données à faible latence et à mise à l'échelle linéaire pour maintenir la saturation des pipelines d'accélération lors de charges de travail distribuées.
Parallèlement aux mises à jour de sa plateforme, Nutanix a lancé le programme « Powered by Nutanix : Verified Services » et annoncé la disponibilité générale de Service Provider (SP) Central. SP Central offre une plateforme de contrôle mutualisée permettant aux fournisseurs de services gérés de provisionner, d'exploiter et de monétiser des services d'infrastructure, de conteneurs et d'IA grâce à des modèles de licences flexibles.
NAI 2.8 et SP Central sont disponibles immédiatement, tandis que NKP 2.19 devrait sortir prochainement.




Amazon