StorageReview.com

Broadcom představuje VMware Private AI Cloud: Ověřené modely, AI Factory a agenti Deny-by-Default

AI  ◇  Enterprise

Společnost Broadcom na konferenci VMware Explore představila VMware Private AI Cloud, architekturu privátního cloudu navrženou pro spouštění modelů umělé inteligence v blízkosti podnikových dat. Platforma má za cíl přenést modely k datům v rámci privátní infrastruktury organizace, nikoli k přesunu citlivých dat k externím poskytovatelům modelů.

VMware Private AI Cloud kombinuje VMware Cloud Foundation (VCF), VMware AI Factory, VMware Tanzu Platform, VMware vDefend a VMware Avi Load Balancer do jednotného prostředí pro spouštění inferenčních úloh, agentních aplikací, kontejnerizovaných služeb a tradičních virtuálních strojů. Tento přístup poskytuje podnikům společný model infrastruktury a provozu pro úlohy s umělou inteligencí a univerzální úlohy a zároveň si zachovává kontrolu nad umístěním dat, bezpečnostními zásadami a spotřebou zdrojů.

Snímek platformy VMware Private AI Cloud zobrazující platformu agentů, infrastrukturu a zabezpečení agentů, model jako služba a vrstvy infrastruktury AI

Prezident společnosti Broadcom Infrastructure Software Group Ram Velaga popsal platformu jako bod sbližování mezi privátním cloudem a privátní infrastrukturou umělé inteligence. Cílem je podporovat produkční inferenci a agentní aplikace, aniž by se musela vzdát datové suverenity, kontrolních mechanismů nebo předvídatelných provozních nákladů.

VCF se zaměřuje na infrastrukturu umělé inteligence a náklady na tokeny

VMware Private AI Cloud je navržen tak, aby řešil tři hlavní oblasti nákladů v podnikových nasazeních umělé inteligence: kapitálové výdaje na hardware, provozní složitost a spotřebu tokenů. Tyto náklady se mohou zvyšovat s tím, jak organizace přecházejí z malých pilotních projektů umělé inteligence na produkční inferenční úlohy, které vyžadují větší modely, vyšší objemy požadavků a větší kapacitu GPU.

VMware Cloud Foundation 9 zavádí funkce infrastruktury určené ke zlepšení využití zdrojů. Vrstvení paměti NVMe může rozšířit dostupnou paměťovou kapacitu použitím rychlého úložiště NVMe jako další vrstvy, zatímco deduplikace úložiště v celém clusteru snižuje duplicitní data v celém prostředí. Tyto funkce jsou navrženy tak, aby zlepšily efektivitu infrastruktury pro úlohy umělé inteligence, které vyžadují značné paměťové a úložné zdroje.

Prezentace společnosti VMware uvádí 42% úsporu hardwaru díky vrstvení paměti NVMe oproti konfiguraci serveru s pouze DRAM

VCF také podporuje heterogenní infrastrukturu, včetně CPU, GPU a dalších akcelerátorů od různých dodavatelů. Platforma podporuje serverové systémy dodávané hlavními výrobci OEM a ODM, což organizacím umožňuje vybrat si hardware na základě požadavků na pracovní zátěž, dostupnosti a nákladů, spíše než přijmout jednu hardwarovou konfiguraci.

Platforma také přidává funkce správy pro řízení spotřeby zdrojů umělé inteligence. Monitorování tokenů poskytuje přehled o využití modelu a aktivitě inference, zatímco sdílení modelu mezi více klienty umožňuje více uživatelům nebo aplikacím přístup ke společným službám modelů. Vylepšené sledování GPU a vGPU poskytuje podrobnější informace o alokaci a využití akcelerátorů. Panel s metrikami umělé inteligence zobrazuje tato měření v centralizovaném provozním pohledu.

VMware AI Factory automatizuje cestu k produkci

Společnost Broadcom také oznámila VMware AI Factory, softwarově definovaný základ pro VMware Private AI Cloud. VMware AI Factory má zjednodušit nasazení infrastruktury připravené pro umělou inteligenci a zkrátit dobu potřebnou k přechodu z fyzického hardwaru na koncový bod produkčního modelu.

Představujeme slajd VMware AI Factory s modelem jako službou a komponentami infrastruktury AI

Platforma je navržena tak, aby pokrývala jak počáteční nasazení infrastruktury, tak i průběžný provoz v 2. dni. To zahrnuje automatizaci zřizování infrastruktury, nasazení modelových služeb a správu provozních požadavků úloh umělé inteligence po nasazení. Broadcom také prezentuje VMware AI Factory jako mechanismus pro zlepšení přehledu o ekonomice tokenů a spotřebě zdrojů s rostoucím využíváním modelů.

Runtime modelů VCF je založen na vLLM, který poskytuje společnou obslužnou vrstvu pro podporované modely. Společnost Broadcom uvedla, že zákazníci VCF mohou prostřednictvím platformy provozovat více než 150 open-source a komerčních modelů. To umožňuje organizacím vybírat modely na základě jazykové podpory, kontextových požadavků, multimodálních možností, výkonu uvažování a kompatibility hardwaru.

Ověřené modely umožňují služby privátních modelů

Společnost Broadcom oznámila, že modely od společností Google, NVIDIA, NEC, Alibaba Cloud a Z.ai byly testovány a ověřeny pro VMware Cloud Foundation. Ověřovací program má podnikům poskytnout jasnější cestu k nasazení vybraných modelů v místních podmínkách a jejich zpřístupnění interním uživatelům prostřednictvím nabídek Model-as-a-Service.

Prezentace modelu jako služby na VMware Cloud Foundation s ověřenými modely od společností Google, NVIDIA, NEC, Alibaba a Z.ai

Mezi ověřené modely oznámené pro VCF patří:

  • NVIDIA Nemotron 3: Rodina Nemotron 3 zahrnuje otevřené multimodální modely založené na hybridní architektuře Mamba-Transformer Mixture-of-Experts. Modely podporují kontextové okno až do 1 milionu tokenů a jsou navrženy pro dlouhodobé agentní pracovní postupy napříč podnikovými aplikacemi.
  • Google DeepMind Gemma 4: Gemma 4 je open-source multimodální model s otevřenou váhou určený pro lokální spuštění. Jeho dostupnost na VCF dává organizacím možnost vyvíjet a nasazovat autonomní agenty v rámci vlastní infrastruktury.
  • NEC cotomi: Model cotomi od společnosti NEC je optimalizován pro japonštinu a trénován na upravených datových sadách. Společnost Broadcom uvedla, že model přináší 40% zlepšení efektivity tokenů.
  • Alibaba Cloud Qwen 3.7-27B: Proprietární multimodální model s kontextovým oknem o velikosti 1 milionu tokenů. Zahrnuje funkce multimodálního uvažování a je navržen pro agentní úlohy.
  • Z.ai GLM 5.2: GLM 5.2 je open-source General Language Model určený pro lokální kódovací a uvažující agenty. Model je určen k podpoře vícekrokových autonomních pracovních postupů a zároveň k uchování dat v podnikovém prostředí.

Cílem validace modelů je snížit nejistotu při nasazení pro podniky, které chtějí provozovat komerční a open-source modely na soukromé infrastruktuře. Společnost Broadcom uvedla, že poskytovatelé modelů se společností spolupracují na zpřístupnění validovaných modelů prostřednictvím integrovaných služeb VCF.

Zpráva společnosti Broadcom Private Cloud Outlook 2026 uvádí, že 56 procent podniků již provozuje nebo plánuje provozovat produkční inferenci umělé inteligence v privátním cloudu. VCF je připravena podporovat tato nasazení vedle stávajících virtuálních strojů, úloh Kubernetes a kontejnerizovaných služeb.

Nezávislé testování s využitím standardů MLPerf Inference v5.1 podle společnosti Broadcom potvrdilo, že VCF poskytuje výkon srovnatelný s infrastrukturou typu bare metal. Testování má prokázat, že virtualizace a správa privátního cloudu mohou podporovat produkční inferenci bez nutnosti samostatného stacku AI s holým kovem.

Hloubková obrana pro úlohy s umělou inteligencí

VMware Private AI Cloud využívá model hloubkové bezpečnosti, který je v souladu s rámcem NIST Cybersecurity Framework 2.0. Platforma kombinuje kontroly infrastruktury, segmentaci sítě, ochranu na aplikační vrstvě, zabezpečení dodavatelského řetězce a funkce pro zajištění souladu s předpisy.

Vícevrstvé mapování obrany VMware, vDefend IDPS, distribuovaný firewall a NDR proti útokům s podporou umělé inteligence na hranicích

VMware vDefend poskytuje mikrosegmentaci a laterální bezpečnostní kontroly na úrovni hypervizoru. Virtuální záplatování je navrženo tak, aby chránilo úlohy před známými zranitelnostmi, aniž by vyžadovalo okamžité změny aplikací nebo výpadky infrastruktury. Monitorování toku provozu může také identifikovat neočekávanou komunikaci mezi úlohami a pomoci odhalit neoprávněné nebo stínové nasazení umělé inteligence.

Prezentace distribuovaných virtuálních záplat vDefend zobrazující generování podpisů agentní umělou inteligencí pro IDPS

Společnost Broadcom rozšiřuje technologii vDefend na agentní úlohy s umělou inteligencí. Aktualizované funkce jsou navrženy tak, aby identifikovaly agentní komponenty prostřednictvím nepřetržitého monitorování provozu, detekovaly neoprávněné použití systémů umělé inteligence a distribuovaly virtuální záplaty pomocí signatur systémů detekce a prevence narušení generovaných umělou inteligencí.

VMware Avi Load Balancer přidává ochranu na aplikační vrstvě prostřednictvím svého firewallu webových aplikací a funkcí zabezpečení API. Pro úlohy agentů je Avi navržen tak, aby omezil přístup agentů k neoprávněným nástrojům, identifikoval anomální chování, které může naznačovat zero-day útok, a aplikoval kontrolní mechanismy ochrany dat, které pomáhají předcházet neoprávněnému úniku dat.

TrueSource rozšiřuje kontroly dodavatelského řetězce s otevřeným zdrojovým kódem

Společnost Broadcom také představila funkce TrueSource pro softwarové a datové služby používané v soukromých prostředích umělé inteligence. TrueSource Trusted Artifacts aplikuje procesy sestavení v čistých prostorách napříč ekosystémy Java, Python a Node.js a katalogem Bitnami Secure Images.

Snímek Broadcom TrueSource o Spring Enterprise, TrueSource Data Services a důvěryhodných artefaktech

Verze Spring Enterprise jsou spravovány a spravovány týmem Spring. Společnost Broadcom uvedla, že verze obsahují záplaty, které jsou skenovány oproti modelům Frontier a ověřovány lidmi, přičemž opravy jsou dodávány napříč podporovanými řadami vydání.

TrueSource Data Services rozšiřuje stejný přístup na komponenty datové infrastruktury. Mezi počáteční služby patří PostgreSQL, RabbitMQ, MySQL a Valkey. To poskytuje kontrolovaný zdroj pro běžně nasazované databázové a messagingové komponenty, které mohou podporovat aplikace umělé inteligence a agentní pracovní postupy.

Platforma Tanzu přidává ovládací prvky pro autonomní agenty

Společnost Broadcom také oznámila nové datové základny připravené pro umělou inteligenci a funkce běhového prostředí agentů pro platformu VMware Tanzu. Platforma Tanzu je prezentována jako platforma pro aplikace a agenty pracující v rámci VMware Private AI Cloud.

Datové základy Tanzu Platform připravené pro umělou inteligenci s fázemi příjmu, strukturování, správy a publikování a integrovaným serverem MCP

Autonomní agenti s sebou nesou rizika, která se liší od rizik spojených s konvenčními aplikacemi. Agenti mohou nezávisle dotazovat data, spouštět nástroje, interpretovat instrukce a provádět akce napříč propojenými systémy. Bez dostatečných kontrol může agent překročit svůj přidělený rozsah, přistupovat k neoprávněným zdrojům, zveřejnit citlivé informace nebo generovat neočekávané náklady na infrastrukturu a cloudový výstup.

Platforma Tanzu řeší tato rizika pomocí běhového modelu s denial-by-deniy (denií ve výchozím nastavení). Agenti nemají přístup k API, sítím, MCP serverům ani internetu, pokud jim není výslovně udělen. Izolované úložiště přihlašovacích údajů skrývá přihlašovací údaje před samotnými agenty, čímž se snižuje riziko krádeže přihlašovacích údajů, zneužití a útoků typu prompt injection.

Platforma také zahrnuje předpřipravený vývojářský balíček se schválenými dovednostmi, balíčky pro tvorbu pracovních postupů, ovládací prvky typu „human-in-the-loop“ a integrované paměťové služby. Tyto komponenty mají za cíl poskytnout řízenou cestu vývoje pro sestavovací agenty a zároveň zachovat provozní záruky během provádění.

AgentMinder poskytuje centralizovanou kontrolu agentů

Společnost Broadcom představila AgentMinder jako centrální řídicí rovinu pro autonomní agenty s umělou inteligencí. Systém zachází s každým agentem jako s podnikovou identitou a přiřazuje tuto identitu k definovanému poslání, schváleným nástrojům a autorizovaným zdrojům.

Představujeme slajd AgentMinder, který ukazuje agentickou strukturu identity, zabezpečení a pozorovatelnosti.

Vynucování zásad za běhu aplikuje na volání nástrojů ovládací prvky s nejnižšími oprávněními. To umožňuje podnikům určit, které nástroje může agent používat a za jakých podmínek. AgentMinder také poskytuje auditní záznamy o aktivitě agentů, což bezpečnostním a compliance týmům poskytuje přehled o akcích prováděných autonomními systémy.

Kombinace identity agenta, vynucování zásad a auditovatelnosti má poskytnout vrstvu správy a řízení pro organizace nasazující více agentů napříč odděleními a aplikacemi.

Datové základy připravené na umělou inteligenci zachovávají kontext v podniku

Nové datové základy připravené pro umělou inteligenci v platformě Tanzu zpracovávají strukturovaná i nestrukturovaná podniková data v prostředí řízeném zákazníkem. Výsledné datové produkty jsou navrženy tak, aby agentům poskytovaly kurátorované, kontextově bohaté informace, aniž by bylo nutné zdrojová data opustit privátní cloud.

Snímek s agentickou umělou inteligencí platformy Tanzu s podrobnostmi o sandboxu s denial-by-default, postroji pro sestavení agenta a filtrování nástrojem MCP

Tyto datové produkty lze publikovat na tržišti platformy Tanzu jako řízené služby. Vývojáři a agenti mohou tyto služby vyhledávat a využívat prostřednictvím centralizovaného katalogu, zatímco vlastníci dat si ponechávají kontrolu nad tím, jak jsou informace připravovány, zveřejňovány a spravovány.

Tento přístup má za cíl zlepšit kvalitu kontextu dostupného agentům, snížit závislost na neupravených datech a snížit spotřebu tokenů tím, že modelu dodává relevantnější informace. Pomáhá také uchovávat citlivá data, metadata a výpočetní zdroje v rámci kontrolované infrastruktury organizace.

dostupnost

Společnost Broadcom uvedla, že nové funkce platformy VMware Tanzu oznámené na konferenci VMware Explore budou všeobecně dostupné na podzim roku 2026.

Zapojte se do StorageReview

Zpravodaj | YouTube | Podcast iTunes / Spotify | Instagram | Twitter | TikTok | RSS kanál

Harold Fritts

V technologickém průmyslu působím od doby, kdy IBM založila Selectric. Mám ale zkušenosti s psaním. Rozhodl jsem se tedy opustit předprodejní byznys a vrátit se ke svým kořenům, trochu psát, ale stále se věnovat technologiím.