Bijgewerkt op 9 september 2026: Het HP ZGX Fury AI Station, het tweede GB300-systeem dat we hebben ontvangen, bevindt zich in het lab en wordt getest.
Elk systeem dat op deze pagina wordt vermeld, is getest in het StorageReview-lab. We benchmarken de lokale AI-prestaties direct: vLLM online serving throughput, time-to-first-token en time-per-output-token voor modellen zoals GPT-OSS-120B, Llama 3.1 8B, Mistral Small 3.1 24B en Qwen3 Coder 30B, plus MAMF compute efficiency en GDSIO storage tests. Geen enkel systeem wordt gerangschikt op basis van een specificatieblad.
De bepalende vraag voor een lokale AI-desktop in 2026 is: geïntegreerd geheugen versus afzonderlijk VRAM ? Desktop-systemen zoals NVIDIA's GB10-gebaseerde DGX Spark en AMD's Ryzen AI Max (Strix Halo) systemen bieden 128 GB geïntegreerd geheugen op één chip voor een aantrekkelijke prijs, waardoor modellen mogelijk zijn die anders meerdere afzonderlijke GPU's zouden vereisen. Workstation-torens bieden een antwoord met pure doorvoer: RTX PRO 6000 Blackwell-kaarten leveren aanzienlijk meer tokens per seconde, maar dit gaat gepaard met een veel hogere prijs en een hoger stroomverbruik. Deze pagina rangschikt beide systemen in aparte categorieën op basis van één consistente testsuite, omdat het juiste antwoord afhangt van het grootste model dat u wilt draaien en hoe snel u de respons wilt hebben.
In een oogopslag
| Categorie | Systeem | Geheugen | GPU's (getest / maximaal) | Volledige recensie |
|---|---|---|---|---|
| Beste AI-systeem voor gebruik op het bureau in het algemeen | NVIDIA DGX-Spark | 128 GB gecombineerd LPDDR5X-geheugen | GB10 geïntegreerd (vast) | DGX Spark review |
| Beste GB10-implementatie | Acer Veriton GN100 | 128 GB gecombineerd LPDDR5X-geheugen | GB10 geïntegreerd (vast) | Veriton GN100 recensie |
| Beste x86-alternatief | AMD Ryzen AI-halo (Strix-halo) | Tot 128 GB aan gecombineerd LPDDR5X-geheugen | Geïntegreerde Radeon 8060S (vast) | Ryzen AI Halo review |
| Het beste resultaat zonder aparte grafische kaart. | HP Z2 Mini G1a | Unified LPDDR5X (draaide GPT-OSS 120B) | Geïntegreerd, geen dGPU (vast) | Review van de Z2 Mini G1a |
| Beste GB300-systeem | MSI XpertStation WS300 | 748 GB coherent (252 GB HBM3e + 496 GB LPDDR5X) | GB300 geïntegreerd (vast) | Review van de XpertStation WS300 |
| Beste toren voor lokale AI | Dell Precision 7875 | 192 GB GDDR7 (2 x 96 GB) | 2× RTX PRO 6000 / 2 max | Review van de Precision 7875 |
| Beste platform met meerdere GPU's | HP Z8 Fury G6i | 192 GB GDDR7 zoals getest / tot 384 GB | 2× RTX PRO 6000 getest / 4 max. | Review van de Z8 Fury G6i |
| De extreme keuze | Comino Grando RTX PRO 6000 | 768 GB GDDR7 (8 x 96 GB) | 8× RTX PRO 6000 / 8 max | Comino Grando recensie |
AI-apparaten voor op het bureau
De appliance-categorie, wat Dell deskside AI noemt en NVIDIA de persoonlijke AI-supercomputer , ruilt piekdoorvoer in voor modelcapaciteit, energie-efficiëntie en prijs. Met 128 GB aan geïntegreerd geheugen kunnen deze systemen probleemloos 70B-klasse modellen met hoge kwantisering aan en zelfs 120B-klasse taken, waarvoor in een tower-pc meerdere afzonderlijke GPU's nodig zouden zijn.
Essentiële laboratoriuminformatie voor deze categorie: onze DGX Spark thermische test vergelijkt OEM-koelingsontwerpen van de onderstaande GB10-systemen en is van toepassing op elk apparaat in deze klasse totdat deze platforms een herziening ondergaan.
Beste AI-systeem voor gebruik op het bureau: NVIDIA DGX Spark
De DGX Spark is de maatstaf waaraan alle andere desktop AI-systemen worden afgemeten. De GB10 Grace Blackwell-superchip combineert een 20-core Arm CPU met 128 GB aan LPDDR5X-geheugen en twee ConnectX-7 200GbE-poorten, waardoor het de enige appliance in onze testklasse is die direct clustering mogelijk maakt: onze tests met gedistribueerde inferentie op twee nodes voerden parallelle workloads uit op Dell-, GIGABYTE- en HP-nodes via 200GbE. De CUDA-softwarestack blijft de meest uitgebreide in dit segment.
Lees de volledige DGX Spark-recensie
Beste GB10-implementatie: Acer Veriton GN100
Bij de GB10 OEM-systemen is het thermische ontwerp de belangrijkste factor die het verschil maakt, en de Veriton GN100 kwam in onze tests als beste uit de bus. Alle GB10-systemen delen dezelfde chip en geheugenconfiguratie, dus de prestaties hangen grotendeels af van de koeling. Onze vergelijking van de koeling van meerdere OEM-systemen is, voor zover wij weten, de enige in zijn soort die gepubliceerd is.
Lees de volledige recensie van de Veriton GN100.
Beste x86-alternatief: AMD Ryzen AI Halo
Als je Windows of een standaard x86-softwarepakket nodig hebt, is Strix Halo de ideale oplossing voor op je bureau. AMD's Ryzen AI Max+ 395-platform combineert 128 GB aan geïntegreerd geheugen met een dual-OS-configuratie en in onze tests kon het modellen van de 200B-parameterklasse aan, een directe concurrent voor de DGX Spark zonder de verplichting van Arm/DGX OS.
Lees de volledige Ryzen AI Halo-recensie.
Beste keuze zonder aparte grafische kaart: HP Z2 Mini G1a
De Z2 Mini G1a draaide GPT-OSS 120B helemaal zonder aparte grafische kaart. HP's mini-werkstation combineert AMD's Ryzen AI Max+ PRO-processor in een compacte, stille en IT-vriendelijke behuizing en is daarmee het duidelijkste bewijs dat x86-systemen met geïntegreerd geheugen de mogelijkheden van een kleine kantoorcomputer hebben veranderd ten opzichte van grotere modellen.
Lees de volledige review van de Z2 Mini G1a
Beste GB300-systeem: MSI XpertStation WS300
De WS300 is het eerste GB300 DGX-station dat we in ons lab hebben getest en legt de lat voor dit type appliance opnieuw hoog. De Grace Blackwell Ultra-superchip combineert 748 GB coherent geheugen, bestaande uit 252 GB HBM3e en 496 GB LPDDR5X, met een rekenkracht van 20 petaFLOPS FP4. In onze tests verwerkte het systeem een 433 GB GLM-5.2 checkpoint met 216 GB aan expert-gewichten in het Grace-geheugen – een model dat eigenlijk niet op een bureau thuishoort. Net als elk DGX-systeem draait het op DGX OS in plaats van Windows; dat is de prijs die zo'n grote hoeveelheid geheugen vereist. Qua prijs en vermogen bevindt het zich dichter bij de topmodellen in de tower-categorie dan bij de GB10-systemen daarboven, maar geen enkel ander apparaat in deze categorie biedt een dergelijk groot formaat.
Lees de volledige recensie van de XpertStation WS300.
In het lab: HP ZGX Fury AI-station

De HP ZGX Fury AI Station, het tweede GB300-systeem dat in ons lab is aangekomen.
De HP ZGX Fury AI Station bevindt zich momenteel in ons lab. Hij is gebouwd op hetzelfde NVIDIA GB300 Grace Blackwell Ultra-platform als de MSI XpertStation WS300 hierboven, waardoor het de eerste kans is om te zien hoe de implementaties van de DGX Station-architectuur van twee fabrikanten zich op dezelfde testopstelling verhouden: thermische prestaties, geluidsproductie, continue kloksnelheden en de praktische ervaring met de machine. De tests zijn in volle gang en de ZGX Fury wordt in de ranglijst opgenomen zodra de resultaten bekend zijn.
In aantocht: AMD Threadripper Halo Station
De Threadripper Halo Station van AMD, aangekondigd op IFA 2026 maar nog niet in een testlab getest, is het eerste directe antwoord op de GB300-klasse hierboven. De aanpak is precies het tegenovergestelde van NVIDIA: in plaats van één grote, samenhangende geheugenpool, combineert AMD een 96-core Threadripper PRO op een platform met maximaal 2 TB aan achtkanaals DDR5 en 128 PCIe 5.0-lanes met twee 600W Instinct MI350P-acceleratoren die elk 144 GB HBM3E ondersteunen, en een uitbreidingsmogelijkheid naar vier kaarten en 576 GB HBM. Het hele systeem is vloeistofgekoeld en de x86-host omzeilt de problemen met de Arm-toolchain die we in de WS300-review hebben aangekaart. De vraag is hoe goed modellen presteren met PCIe-kaarten in combinatie met NVLink-C2C-coherentie. AMD heeft nog geen benchmarks, prijzen of beschikbaarheid bekendgemaakt, dus dit is een product om in de gaten te houden, geen product om aan te schaffen. Meer details zijn te vinden in ons bericht over de aankondiging . Het wordt in de ranglijst opgenomen zodra de hardware het lab bereikt.
Ook getest: AI-apparaten voor op het bureau
Deze systemen hebben hetzelfde testproces in het laboratorium doorlopen en zijn solide keuzes die geen plek in een categorie hebben ingenomen: Dell Pro Max met GB10 , ASUS Ascent GX10 , GIGABYTE AI TOP ATOM , HP ZGX Nano G1n en HP EliteDesk 8 Mini G1a.
Werkstationtorens voor lokale AI
Wanneer responstijd belangrijker is dan aanschafkosten (interactieve codeerassistenten, multi-user service, agentische pipelines met lange tool-call chains), blijft discreet VRAM de beste keuze. Deze towers worden hier gerangschikt op inferentiedoorvoer en geheugenlimiet. Voor elk systeem vermelden we de GPU-configuratie die we hebben getest, samen met de maximale capaciteit van de behuizing. Wat een behuizing uiteindelijk kan bevatten is immers net zo belangrijk als wat er in onze build is meegeleverd. Op onze pagina met de beste desktopwerkstations worden ze apart gerangschikt ten opzichte van SPECworkstation en rendering workloads, omdat ze twee verschillende vragen beantwoorden.
Beste tower voor lokale AI: Dell Precision 7875
Dankzij de twee RTX PRO 6000 Blackwell GPU's is de Precision 7875 het snelste standaard-systeem dat we hebben getest voor lokale inferentie. Met een Threadripper PRO 9995WX en 192 GB gecombineerd VRAM verdeeld over twee kaarten, kan het 100B-klasse modellen volledig in GPU-geheugen verwerken en levert het interactieve time-to-first-token die geen enkel systeem met geïntegreerd geheugen kan evenaren. Houd echter rekening met de limiet: de 7875-behuizing ondersteunt maximaal twee dual-width kaarten, dus onze configuratie met twee GPU's is de maximale configuratie; het is niet mogelijk om later een derde kaart toe te voegen.
Lees de volledige review van de Precision 7875.
Beste platform met meerdere GPU's: HP Z8 Fury G6i
De Z8 Fury G6i is de tower die je koopt als je van plan bent om in de toekomst meer GPU's te installeren. Ons testmodel had twee RTX PRO 6000 Max-Q-kaarten met een gecombineerd VRAM van 192 GB, maar de behuizing, gevoed door twee voedingen met een totaal vermogen van 2700 W, ondersteunt tot vier Blackwell-kaarten en 384 GB VRAM. Dat verschil tussen de geteste en de maximale configuratie is precies de bedoeling: geen enkele standaard OEM-tower die we hebben getest biedt meer ruimte voor GPU's, en de overstap van twee naar vier kaarten vereist geen aanpassing van de behuizing.
Lees de volledige review van de Z8 Fury G6i
De extreme keuze: Comino Grando RTX PRO 6000
768 GB VRAM in een vloeistofgekoelde 4U-behuizing: de Grando is er voor de koper wiens model nergens anders past. Ons testexemplaar werd geleverd met acht RTX PRO 6000 Blackwell-kaarten van elk 96 GB, het maximum dat de behuizing toelaat, en Comino's vloeistofkoeling houdt alle acht kaarten continu op volle TDP zonder throttling. Dat is meer GPU-geheugen dan veel rackservers, in een behuizing die nog steeds naast een bureau past. De prijs is hoog, maar het geluid niet, en het is bewust de buitenbeentje in deze lijst: het bewijs van waar de grenzen van een bureaubehuizing daadwerkelijk liggen.
Lees de volledige recensie van Comino Grando
Hoe we rang
Drie regels zijn van toepassing op elke StorageReview-ranglijst. Ten eerste worden alleen in het lab geteste systemen gerangschikt. Als we een systeem niet hebben gebenchmarkd, mag het wel worden genoemd, maar het mag geen categorie toegewezen krijgen. Ten tweede worden systemen één keer per meetmethode gerangschikt. De bovenstaande towers staan ook op onze ranglijst voor desktopwerkstations, waar ze worden gerangschikt op basis van SPECworkstation- en renderingprestaties, en hier op basis van inferentiedoorvoer en geheugenlimiet. Andere vraag, andere gegevens, soms een andere winnaar. Ten derde is er een haalbaarheidscriterium: een systeem moet een 30B-klasse model op interactieve snelheden kunnen draaien, of minimaal 96 GB aan modeltoegankelijk geheugen bieden, om op deze pagina te worden gerangschikt.
De ranglijsten zijn gebaseerd op een combinatie van vLLM online serverdoorvoer, tijd tot eerste token, tijd per outputtoken, MAMF rekenefficiëntie, GDSIO opslagprestaties en verkoopprijs. Bij gelijke scores binnen de ranglijsten beslist de redactie. Leveranciers zien de ranglijsten niet vóór publicatie en plaatsing op deze pagina is niet betaald.
Veelgestelde vragen over lokale AI-desktops
Wat is de beste desktop voor agentische AI?
Agentische workloads zoals codeeragents, tool-calling pipelines en autonome taken met meerdere stappen zijn gevoelig voor doorvoer en latentie op een manier die bij gebruik van één chat niet het geval is, omdat agents veel modelaanroepen met een grote context aan elkaar koppelen. Dat is in het voordeel van de tower-klasse: het discrete VRAM van de Dell Precision 7875 levert de constante tijd tot het eerste token die nodig is om lange agentketens responsief te houden. Voor budgetbewuste agentische experimenten draait een GB10-klasse appliance dezelfde stacks op een lagere snelheid. Onze volledige richtlijnen voor dimensionering vindt u in RAM, GPU & Storage voor Agentische AI.
Hoeveel geheugen heb ik nodig om een 70B-model lokaal te draaien?
In de praktijk heeft een 70B-model met 4-bits kwantisering ongeveer 40-48 GB aan modeltoegankelijk geheugen nodig vóór context; comfortabel interactief gebruik met zinvolle context vereist meer. Daarom kunnen apparaten met 128 GB aan uniform geheugen 70B-modellen goed aan, en komen systemen met 24-32 GB en één GPU niet aan bod.
Heb ik speciale stroom nodig om deze systemen te laten werken?
Voor de apparaten is het antwoord nee: GB10-klasse boxen en Strix Halo-systemen werken prima op een standaard kantoorstopcontact. Voor de towers is het echter raadzaam om eerst met de eigenaar van het gebouw te overleggen. Een volledig geconfigureerde HP Z8 Fury G6i kan twee voedingen met een totaal vermogen tot 2700W aan, meer dan een standaard 15-ampère, 120V-aansluiting kan leveren. De Comino Grando specificeert 2000W hot-swap voedingen die een ingangsspanning van 180-264V vereisen, en 1000W-units op 110V. Controleer voordat u iets koopt wat bovenaan deze pagina staat aangegeven, wat het stopcontact daadwerkelijk aankan; een aparte stroomkring of een 208/240V-aansluiting kan deel uitmaken van de werkelijke kosten van een complete GPU-configuratie. Warmteontwikkeling volgt dezelfde formule, aangezien elke verbruikte watt uiteindelijk in de ruimte terechtkomt.
En wat dacht je van een Mac Studio?
Niet op dit moment, en niet alleen omdat we er nog geen in het lab hebben kunnen testen. Apple is gestopt met de verkoop van de Mac Studio-configuraties met veel geheugen, wat juist het enige echte voordeel van de machine was voor lokale AI: voldoende uniform geheugen om zeer grote modellen op te slaan. Zonder die configuraties is het huidige aanbod geen serieuze kandidaat voor deze pagina. Apple zal naar verwachting de Mac Studio dit jaar vernieuwen; als de opties met veel geheugen terugkeren, zullen we er een testen en onze mening herzien.




Amazon