OpslagReview. com

Broadcom introduceert VMware Private AI Cloud: gevalideerde modellen, AI Factory en agents met standaardtoegangsbeperking.

AI  ◇  Enterprise

Broadcom introduceerde VMware Private AI Cloud tijdens VMware Explore, een private cloudarchitectuur die is ontworpen om AI-modellen dicht bij de bedrijfsgegevens uit te voeren. In plaats van gevoelige gegevens naar externe modelaanbieders te verplaatsen, is het de bedoeling dat het platform de modellen naar de gegevens binnen de eigen infrastructuur van een organisatie brengt.

VMware Private AI Cloud combineert VMware Cloud Foundation (VCF), VMware AI Factory, VMware Tanzu Platform, VMware vDefend en VMware Avi Load Balancer in één uniforme omgeving voor het uitvoeren van inferentieworkloads, agentapplicaties, containerdiensten en traditionele virtuele machines. Deze aanpak biedt bedrijven een gemeenschappelijk infrastructuur- en operationeel model voor AI- en algemene workloads, terwijl ze de controle behouden over de datalocatie, het beveiligingsbeleid en het resourceverbruik.

Dia van het VMware Private AI Cloud-platform met de agentplatform-, infrastructuur- en agentbeveiligings-, model-as-a-service- en AI-infrastructuurlagen.

Ram Velaga, president van Broadcom Infrastructure Software Group, omschreef het platform als een convergentiepunt tussen private cloud en private AI-infrastructuur. Het doel is om productie-inferentie en agentische applicaties te ondersteunen zonder in te leveren op datasoevereiniteit, compliancecontroles of voorspelbare operationele kosten.

VCF richt zich op AI-infrastructuur en tokenkosten.

VMware Private AI Cloud is ontworpen om drie belangrijke kostenposten bij AI-implementaties in bedrijven aan te pakken: investeringen in hardware, operationele complexiteit en tokenverbruik. Deze kosten kunnen oplopen naarmate organisaties overstappen van kleinschalige AI-pilots naar productieworkloads voor inferentie, die grotere modellen, hogere aanvraagvolumes en meer GPU-capaciteit vereisen.

VMware Cloud Foundation 9 introduceert infrastructuurmogelijkheden die zijn ontworpen om het resourcegebruik te verbeteren. NVMe-geheugentiering kan de beschikbare geheugencapaciteit uitbreiden door snelle NVMe-opslag als extra laag te gebruiken, terwijl clusterbrede opslagdeduplicatie dubbele gegevens in de omgeving vermindert. Deze mogelijkheden zijn ontworpen om de infrastructuurefficiëntie te verbeteren voor AI-workloads die aanzienlijke geheugen- en opslagbronnen vereisen.

Een VMware-slide toont een hardwarebesparing van 42 procent door NVMe-geheugentiering in vergelijking met een serverconfiguratie met alleen DRAM.

VCF ondersteunt ook heterogene infrastructuren, waaronder CPU's, GPU's en andere accelerators van verschillende leveranciers. Het platform ondersteunt serversystemen van grote OEM- en ODM-fabrikanten, waardoor organisaties hardware kunnen selecteren op basis van workloadvereisten, beschikbaarheid en kosten, in plaats van één enkele hardwareconfiguratie te kiezen.

Het platform voegt ook beheermogelijkheden toe voor het controleren van het AI-resourceverbruik. Tokenmonitoring biedt inzicht in het modelgebruik en de inferentieactiviteit, terwijl het delen van modellen tussen meerdere gebruikers of applicaties toegang geeft tot gemeenschappelijke modelservices. Verbeterde GPU- en vGPU-tracking biedt gedetailleerdere informatie over de toewijzing en het gebruik van accelerators. Een dashboard voor het observeren van AI-metrics brengt deze metingen samen in een gecentraliseerd operationeel overzicht.

VMware AI Factory automatiseert het traject naar productie.

Broadcom kondigde ook VMware AI Factory aan, de softwarematige basis voor VMware Private AI Cloud. VMware AI Factory is bedoeld om de implementatie van AI-geschikte infrastructuur te vereenvoudigen en de tijd te verkorten die nodig is om van fysieke hardware naar een productiemodel te migreren.

Introductie van de VMware AI Factory-slide met model-as-a-service- en AI-infrastructuurcomponenten.

Het platform is ontworpen om zowel de initiële infrastructuurimplementatie als de doorlopende operationele werkzaamheden na de implementatie te ondersteunen. Dit omvat het automatiseren van de infrastructuurvoorziening, het implementeren van modelservices en het beheren van de operationele vereisten van AI-workloads na de implementatie. Broadcom positioneert VMware AI Factory ook als een mechanisme om meer inzicht te krijgen in de tokeneconomie en het resourceverbruik naarmate het modelgebruik toeneemt.

De VCF-modelruntime is gebaseerd op vLLM, dat een gemeenschappelijke serverlaag biedt voor ondersteunde modellen. Broadcom gaf aan dat VCF-klanten meer dan 150 open-source en commerciële modellen via het platform kunnen uitvoeren. Dit stelt organisaties in staat om modellen te selecteren op basis van taalondersteuning, contextvereisten, multimodale mogelijkheden, redeneerprestaties en hardwarecompatibiliteit.

Gevalideerde modellen maken privémodelservices mogelijk.

Broadcom heeft aangekondigd dat modellen van Google, NVIDIA, NEC, Alibaba Cloud en Z.ai zijn getest en gevalideerd voor VMware Cloud Foundation. Het validatieprogramma is bedoeld om bedrijven een duidelijker traject te bieden voor het implementeren van geselecteerde modellen op locatie en het beschikbaar stellen ervan aan interne gebruikers via Model-as-a-Service-aanbiedingen.

Model-as-a-service op VMware Cloud Foundation-dia met gevalideerde modellen van Google, NVIDIA, NEC, Alibaba en Z.ai

De voor VCF aangekondigde gevalideerde modellen omvatten:

  • NVIDIA Nemotron 3: De Nemotron 3-familie omvat open multimodale modellen gebaseerd op een hybride Mamba-Transformer Mixture-of-Experts-architectuur. De modellen ondersteunen een contextvenster van maximaal 1 miljoen tokens en zijn ontworpen voor langlopende agentische workflows in bedrijfsapplicaties.
  • Google DeepMind Gemma 4: Gemma 4 is een open-source, open-weight multimodale modelfamilie bedoeld voor lokale uitvoering. De beschikbaarheid ervan op VCF biedt organisaties de mogelijkheid om autonome agenten te ontwikkelen en te implementeren binnen hun eigen infrastructuur.
  • NEC cotomi: Het cotomi-model van NEC is geoptimaliseerd voor de Japanse taal en getraind op zorgvuldig samengestelde datasets. Broadcom stelde dat het model een verbetering van 40 procent in tokenefficiëntie oplevert.
  • Alibaba Cloud Qwen 3.7-27B: Een eigen multimodaal model met een contextvenster van 1 miljoen tokens. Het omvat multimodale redeneermogelijkheden en is ontworpen voor agentische workloads.
  • Z.ai GLM 5.2: GLM 5.2 is een open-source General Language Model (GLM) ontworpen voor lokale codeer- en redeneeragenten. Het model is bedoeld om autonome workflows met meerdere stappen te ondersteunen, terwijl de gegevens binnen de bedrijfsomgeving blijven.

Het validatieprogramma voor modellen is erop gericht de onzekerheid bij de implementatie te verminderen voor bedrijven die commerciële en open-source modellen op hun eigen infrastructuur willen draaien. Broadcom heeft aangegeven dat modelaanbieders met het bedrijf samenwerken om gevalideerde modellen beschikbaar te stellen via de geïntegreerde diensten van VCF.

Volgens het rapport Private Cloud Outlook 2026 van Broadcom draait of plant 56 procent van de bedrijven al AI-inferentie in productie op een private cloud. VCF is uitstekend gepositioneerd om deze implementaties te ondersteunen, naast bestaande virtuele machines, Kubernetes-workloads en gecontaineriseerde services.

Onafhankelijke tests met behulp van de MLPerf Inference v5.1-standaarden bevestigden dat VCF prestaties leverde die vergelijkbaar waren met die van een fysieke infrastructuur, aldus Broadcom. De tests waren bedoeld om aan te tonen dat virtualisatie en beheer van een private cloud productie-inferentie mogelijk maken zonder dat een aparte fysieke AI-stack nodig is.

Diepgaande beveiliging voor AI-workloads

VMware Private AI Cloud maakt gebruik van een gelaagd beveiligingsmodel dat is afgestemd op het NIST Cybersecurity Framework 2.0. Het platform combineert infrastructuurbeheer, netwerksegmentatie, bescherming op applicatieniveau, beveiliging van de toeleveringsketen en continue compliance-functies.

VMware-presentatie over meerlaagse verdediging: vDefend IDPS, gedistribueerde firewall en NDR ter bescherming tegen aanvallen met behulp van geavanceerde AI.

VMware vDefend biedt microsegmentatie en laterale beveiligingscontroles op hypervisor-niveau. Virtuele patches zijn ontworpen om workloads te beschermen tegen bekende kwetsbaarheden zonder dat er direct applicatiewijzigingen of downtime van de infrastructuur nodig zijn. Monitoring van het verkeersverkeer kan ook onverwachte communicatie tussen workloads identificeren en helpen bij het opsporen van ongeautoriseerde of verborgen AI-implementaties.

vDefend gedistribueerde virtuele patching-dia met een demonstratie van het genereren van AI-handtekeningen door agenten voor IDPS.

Broadcom breidt vDefend uit naar AI-workloads die gebruikmaken van agents. De bijgewerkte mogelijkheden zijn ontworpen om agentcomponenten te identificeren door middel van continue verkeersmonitoring, ongeoorloofd gebruik van AI-systemen te detecteren en virtuele patches te distribueren met behulp van door AI gegenereerde Intrusion Detection and Prevention System-signaturen.

VMware Avi Load Balancer biedt extra bescherming op applicatieniveau dankzij de webapplicatie-firewall en API-beveiligingsmogelijkheden. Voor workloads met agents is Avi ontworpen om te voorkomen dat agents toegang krijgen tot ongeautoriseerde tools, om afwijkend gedrag te identificeren dat kan duiden op een zero-day-aanval, en om gegevensbeschermingsmaatregelen toe te passen om ongeautoriseerde data-exfiltratie te voorkomen.

TrueSource breidt de controle op de toeleveringsketen van open-sourceprojecten uit.

Broadcom introduceerde ook TrueSource-functionaliteiten voor software- en datadiensten die worden gebruikt in private AI-omgevingen. TrueSource Trusted Artifacts past cleanroom-bouwprocessen toe op de Java-, Python- en Node.js-ecosystemen en de Bitnami Secure Images-catalogus.

Een slide van Broadcom TrueSource over Spring Enterprise, TrueSource Data Services en Trusted Artifacts.

De releases van Spring Enterprise worden beheerd en onderhouden door het Spring-team. Broadcom verklaarde dat de releases patches bevatten die worden gescand aan de hand van geavanceerde modellen en door mensen worden geverifieerd, waarbij de oplossingen worden doorgevoerd in alle ondersteunde releaselijnen.

TrueSource Data Services breidt dezelfde aanpak uit naar data-infrastructuurcomponenten. De initiële services omvatten PostgreSQL, RabbitMQ, MySQL en Valkey. Dit biedt een gecontroleerde bron voor veelgebruikte database- en berichtencomponenten die AI-toepassingen en agentische workflows kunnen ondersteunen.

Tanzu-platform voegt besturingselementen toe voor autonome agenten

Broadcom kondigde ook nieuwe, AI-compatibele datafundamenten en agent-runtimefunctionaliteiten aan voor het VMware Tanzu Platform. Het Tanzu Platform is gepositioneerd als het applicatie- en agentplatform dat opereert binnen de VMware Private AI Cloud.

Tanzu Platform AI-ready datafundamenten met fasen voor data-invoer, -structuur, -beheer en -publicatie, en een ingebouwde MCP-server.

Autonome agents brengen risico's met zich mee die verschillen van die van conventionele applicaties. Agents kunnen zelfstandig gegevens opvragen, tools aanroepen, instructies interpreteren en acties uitvoeren op verbonden systemen. Zonder voldoende controlemechanismen kan een agent zijn toegewezen bevoegdheden overschrijden, toegang krijgen tot ongeautoriseerde bronnen, gevoelige informatie openbaar maken of onverwachte kosten voor infrastructuur en cloudtoegang veroorzaken.

Tanzu Platform pakt deze risico's aan met een runtime-model dat standaard toegang ontzegt. Agents hebben geen toegang tot API's, netwerken, MCP-servers of het internet, tenzij dit expliciet is toegestaan. Een geïsoleerde opslagplaats voor inloggegevens houdt deze gegevens verborgen voor de agents zelf, waardoor het risico op diefstal, misbruik en promptinjectieaanvallen wordt verminderd.

Het platform omvat tevens een vooraf geconfigureerd ontwikkelaarsframework met goedgekeurde vaardigheden, workflow-buildpacks, menselijke tussenkomstcontroles en geïntegreerde geheugenservices. Deze componenten zijn bedoeld om een ​​gecontroleerd ontwikkeltraject te bieden voor het bouwen van agents, terwijl operationele waarborgen tijdens de uitvoering worden gehandhaafd.

AgentMinder biedt gecentraliseerde agentbesturing.

Broadcom heeft AgentMinder onthuld als een centraal controleplatform voor autonome AI-agenten. Het systeem behandelt elke agent als een bedrijfsidentiteit en koppelt die identiteit aan een gedefinieerde missie, goedgekeurde tools en geautoriseerde resources.

Introductie van AgentMinder: een slide die de identiteits-, beveiligings- en observeerbaarheidsstructuur van AgentMinder laat zien.

Het afdwingen van runtimebeleid past het principe van minimale bevoegdheden toe op het aanroepen van tools. Hierdoor kunnen bedrijven bepalen welke tools een agent mag gebruiken en onder welke voorwaarden. AgentMinder biedt bovendien auditlogboeken van agentactiviteiten, waardoor beveiligings- en compliance-teams inzicht krijgen in de acties die door autonome systemen worden uitgevoerd.

De combinatie van agentidentiteit, beleidshandhaving en controleerbaarheid is bedoeld om een ​​beheerslaag te bieden voor organisaties die meerdere agents inzetten in verschillende afdelingen en applicaties.

AI-ready datafundamenten behouden context binnen de onderneming.

De nieuwe, AI-compatibele datafundamenten in het Tanzu-platform verwerken gestructureerde en ongestructureerde bedrijfsdata binnen een door de klant beheerde omgeving. De resulterende dataproducten zijn ontworpen om agents te voorzien van samengestelde, contextrijke informatie zonder dat de brondata de private cloud hoeven te verlaten.

Een dia van Tanzu Platform met agentische AI, waarin de sandbox met standaardweigering, de tool voor het bouwen van agenten en de MCP-toolfiltering worden beschreven.

Deze dataproducten kunnen als beheerde services op de Tanzu Platform-marktplaats worden gepubliceerd. Ontwikkelaars en agents kunnen de services vinden en gebruiken via een gecentraliseerde catalogus, terwijl data-eigenaren de controle behouden over hoe de informatie wordt voorbereid, beschikbaar gesteld en beheerd.

Deze aanpak is bedoeld om de kwaliteit van de context die beschikbaar is voor agenten te verbeteren, de afhankelijkheid van ongefilterde data te verminderen en het tokenverbruik te verlagen door relevantere informatie aan het model te leveren. Het helpt ook om gevoelige data, metadata en computerbronnen binnen de gecontroleerde infrastructuur van de organisatie te houden.

Beschikbaarheid

Broadcom heeft aangegeven dat de nieuwe mogelijkheden van het VMware Tanzu Platform, die tijdens VMware Explore zijn aangekondigd, in het najaar van 2026 algemeen beschikbaar zullen zijn.

Neem contact op met StorageReview

Nieuwsbrief | YouTube | Podcast | iTunes / Spotify | Instagram | Twitter | TikTok | RSS-feed

Harold Frits

Ik zit in de technische industrie sinds IBM Selectric heeft gemaakt. Mijn achtergrond is echter schrijven. Dus besloot ik om uit de pre-sales biz te stappen en terug te keren naar mijn roots, een beetje te schrijven maar nog steeds betrokken te zijn bij technologie.