In concomitanza con le novità relative a Groq 3 LPX presentate a Hot Chips 2026, NVIDIA ha annunciato che SpaceXAI utilizzerà le CPU NVIDIA Vera per accelerare la sua prossima generazione di applicazioni di intelligenza artificiale agentiva. L'azienda prevede inoltre di espandere l'infrastruttura alla base di Grok sulla piattaforma Vera Rubin, man mano che questa raggiunge una capacità di gigawatt, e di estendere tale architettura in orbita con un satellite Starmind AI di prima generazione basato su un sistema Vera Rubin NVL72 ottimizzato.
È interessante notare come sia stata inquadrata la questione, dato che si tratta di una notizia riguardante le CPU in una settimana dominata dagli acceleratori. NVIDIA sostiene che le applicazioni agentive si affidano alla CPU più dell'inferenza convenzionale, poiché gli agenti trascorrono il loro tempo a orchestrare strumenti, eseguire codice, elaborare dati ed eseguire simulazioni tra una chiamata di modello e l'altra. Interrompere questo lavoro rallenta il ciclo dell'agente e costringe le GPU ad attendere.
Vera, la CPU progettata per gli agenti
NVIDIA descrive Vera come la prima CPU progettata per agenti di intelligenza artificiale, pensata per le attività ad alta intensità di calcolo legate all'inferenza dei modelli. L'azienda elenca 88 core Olympus progettati da NVIDIA, la tecnologia NVIDIA Spatial Multithreading e una memoria LPDDR5X ad alta larghezza di banda che offre fino a 1.2 TB/s. NVIDIA afferma che il completamento delle attività è fino a 1.8 volte più veloce rispetto alle CPU x86 in carichi di lavoro di intelligenza artificiale, apprendimento per rinforzo ed elaborazione dati, un dato che non vediamo l'ora di verificare.
Le specifiche corrispondono a quanto mostrato da NVIDIA al momento della presentazione della piattaforma, dove Vera era stata descritta con 176 thread, una larghezza di banda NVLink-C2C di 1.8 TB/s, 1.5 TB di memoria di sistema e 227 miliardi di transistor.
"L'IA agente richiede un nuovo tipo di sistema di calcolo, progettato non solo per generare risposte, ma anche per agire", ha affermato Ian Buck, vicepresidente per il calcolo su larga scala e ad alte prestazioni di NVIDIA. "Vera fornisce agli agenti IA le prestazioni della CPU necessarie per agire in tempo reale, eseguendo codice, elaborando dati e coordinando attività complesse. SpaceXAI sta portando questa architettura dalle enormi fabbriche di IA alla prossima frontiera del calcolo in orbita."
Scaling Grok su Vera Rubin
SpaceXAI prevede di costruire l'infrastruttura alla base di Grok su Vera Rubin, che NVIDIA progetta congiuntamente per quanto riguarda calcolo, rete e software, anziché commercializzarla come componenti separati. Questa architettura combina NVLink, Ethernet Spectrum-X e l'elaborazione dati BlueField, e NVIDIA presenta questa integrazione come la soluzione per ridurre il costo per token su larga scala.
"Vera ci offre le prestazioni della CPU e la larghezza di banda della memoria necessarie per eseguire enormi quantità di orchestrazione, codice ed elaborazione dati, consentendo al contempo alle GPU di svolgere al meglio le proprie funzioni", ha affermato Mike Nicolls, presidente di SpaceXAI. "Questo si traduce in agenti IA più performanti e in un lavoro più utile per ogni watt di potenza di calcolo."
Dalle fabbriche di IA all'orbita
La parte più speculativa dell'annuncio riguarda lo spazio. SpaceXAI sta sviluppando un'infrastruttura di calcolo per l'intelligenza artificiale destinata allo spazio, dove potenza, gestione termica, larghezza di banda, affidabilità e integrazione fisica impongono vincoli che hanno ben poco in comune con quelli di un data center terrestre. Il satellite Starmind di prima generazione, in fase di progettazione, sarà basato su un sistema rack-scale Vera Rubin NVL72 ottimizzato, con NVIDIA e SpaceXAI che adatteranno il design a tali condizioni, mantenendo al contempo un'architettura e un ecosistema software comuni.
NVIDIA si sta preparando a questo: al GTC 2026 ha presentato un modulo Vera Rubin per Space-1 , progettato per il dispiegamento in orbita, come si vede nell'immagine qui sopra. È importante notare che il piano Starmind non è accompagnato da una tempistica, una data di lancio o una cifra relativa alla capacità, e NVIDIA classifica l'intero carico utile come dichiarazioni previsionali.




Amazon