Firma Nutanix ogłosiła ogólną dostępność pakietu Nutanix Enterprise AI (NAI) 2.8 wraz z nadchodzącą premierą platformy Nutanix Kubernetes Platform (NKP) 2.19. Aktualizacje koncentrują się na wypełnieniu luki między starszymi środowiskami wirtualnymi a nowoczesnymi, konteneryzowanymi obciążeniami AI. Dzięki wdrożeniu architektury dwunatywnej, Nutanix dąży do umożliwienia organizacjom równoległego uruchamiania maszyn wirtualnych i konteneryzowanych aplikacji AI w istniejącej infrastrukturze , minimalizując potrzebę tworzenia oddzielnych silosów infrastrukturalnych lub migracji danych między złożonymi warstwami sieciowymi.
„Sztuczna inteligencja w przedsiębiorstwach nie powinna wymagać od klientów przebudowy systemów, na których już działają” – powiedział Thomas Cornely, wiceprezes wykonawczy ds. zarządzania produktami w Nutanix. Podwójnie natywne podejście firmy ma na celu zapewnienie spójnego zarządzania i nadzoru nad maszynami wirtualnymi, kontenerami i frameworkami sztucznej inteligencji, umożliwiając niemal bezobsługowe wykonywanie zadań w systemach zwirtualizowanych, przy jednoczesnym zachowaniu elastyczności architektonicznej.
Architektura i możliwości Nutanix Enterprise AI 2.8
NAI 2.8 zapewnia ujednoliconą płaszczyznę zarządzania do wdrażania, zarządzania i skalowania dużych modeli językowych (LLM) oraz przepływów pracy agentów w środowiskach hybrydowych. Płaszczyzna sterowania zapewnia scentralizowaną widoczność zużycia tokenów, wbudowane metryki obserwowalności oraz funkcjonalność modelu jako usługi.
Aby ułatwić korzystanie z frameworków AI opartych na agentach, platforma wprowadza ogólnodostępną bramę Model Context Protocol (MCP). Brama ta służy jako ujednolicona warstwa dostępu dla agentów AI, umożliwiająca im współpracę z narzędziami zewnętrznymi i zbiorami danych przedsiębiorstwa bez konieczności stosowania niestandardowych rozwiązań inżynieryjnych. Dostępny jest również serwer MCP dla platformy chmurowej Nutanix (NCP), który zapewnia agentom bezpieczny i kontrolowany dostęp do zasobów infrastruktury zarządzanych przez Nutanix.
Po stronie obliczeniowej i serwerowej, NAI 2.8 wprowadza funkcje prywatnego wnioskowania i dostrajania dla wielu GPU. Serwery o wysokiej przepustowości są osiągane dzięki paralelizmowi tensorów w węzłach rozproszonych, uzupełnionemu o przetwarzanie wsadowe i dekodowanie spekulatywne. Dekodowanie spekulatywne wykorzystuje lekkie modele robocze, aby zmniejszyć opóźnienie generowania tokenów nawet 2.5-krotnie bez wpływu na precyzję modelu. W celu dostosowania modelu, platforma wprowadza funkcję dostrajania z efektywnym wykorzystaniem parametrów i adaptacją niskiej rangi (LoRA) dla modeli o liczbie parametrów poniżej 8 miliardów, umożliwiając organizacjom trenowanie adapterów na danych specyficznych dla domeny z wykorzystaniem instancji pojedynczych GPU i wdrażanie ich bezpośrednio w produkcyjnych potokach serwerowych.
Mechanizmy bezpieczeństwa w NAI zostały zaprojektowane tak, aby izolować obciążenia agentów i zapobiegać wyłamywaniu się modeli. Platforma wymusza szczegółowe zarządzanie tożsamościami i dostępem (IAM), niestandardowe mechanizmy kontroli dostępu oparte na rolach, ograniczenia współdzielenia modeli oraz pełną obsługę wdrożeń NVIDIA NIM z izolacją powietrzną.
Dodatki do platformy Nutanix Kubernetes 2.19
Nadchodząca wersja NKP 2.19 koncentruje się na standaryzacji operacji Kubernetes we wdrożeniach fizycznych i wirtualnych. Platforma uzyskała formalny certyfikat CNCF Certified Kubernetes AI Conformance, potwierdzający standaryzację API w zakresie orkiestracji sztucznej inteligencji w przedsiębiorstwie.
W tej wersji wprowadzono NKP Metal, który stosuje zasady zarządzania infrastrukturą hiperkonwergentną do bare-metalowego Kubernetes. Obejmuje to automatyczne dostarczanie systemów operacyjnych, oprogramowania układowego i komponentów środowiska wykonawczego kontenerów, a także natywną pamięć masową. W przypadku wdrożeń zwirtualizowanych, NKP Full Stack na platformie Nutanix AHV integruje się z Nutanix Flow, aby wymusić mikrosegmentację i sandboxing na poziomie sieci, izolując w ten sposób agentów AI i zapobiegając przemieszczaniu się w obrębie sieci.
NKP 2.19 dodaje również starannie dobrany katalog aplikacji AI do automatycznego wdrażania frameworków takich jak Kubeflow, Milvus i Slurm. Zarządzanie zasobami sprzętowymi zostało zaktualizowane o zweryfikowane profile integracji GPU i dynamiczną alokację sprzętu.
Architektura pamięci masowej i programy partnerskie
Przepustowość pamięci masowej pozostaje kluczowym czynnikiem warunkującym stałą wydajność obliczeniową GPU. Aby obsługiwać potoki treningowe i wnioskowania o wysokiej współbieżności, Nutanix Unified Storage (NUS) uzyskał certyfikat NVIDIA na poziomie korporacyjnym. Zweryfikowana architektura zapewnia ścieżki danych o niskim opóźnieniu i skalowalności liniowej, co pozwala utrzymać nasycenie potoków akceleratorów podczas rozproszonych obciążeń.
Oprócz aktualizacji platformy, Nutanix uruchomił program Powered by Nutanix: Verified Services i ogłosił ogólną dostępność Service Provider (SP) Central. SP Central zapewnia wielodostępną płaszczyznę kontroli, która umożliwia dostawcom usług zarządzanych dostarczanie, obsługę i monetyzację usług infrastruktury, kontenerów i sztucznej inteligencji w ramach elastycznych modeli licencjonowania.
NAI 2.8 i SP Central są już dostępne, a wydanie NKP 2.19 planowane jest w niedalekiej przyszłości.




Amazon