StorageReview.com

Microsoft Ignite 2024: progressi nell'infrastruttura Custom Silicon e AI

AI  ◇  Impresa

Microsoft ha annunciato diversi sviluppi chiave nella progettazione di chip personalizzati e nell'infrastruttura AI a Ignite 2024. L'azienda sta espandendo il suo portafoglio di silicio con nuovi chip di sicurezza ed elaborazione dati, rafforzando al contempo la sua partnership con NVIDIA per l'elaborazione AI. Questi aggiornamenti mirano a migliorare l'efficienza, la sicurezza e le prestazioni nei servizi cloud di Microsoft.

La rivoluzione del silicio personalizzato di Microsoft

Microsoft sta ampliando in modo significativo il suo portafoglio di silicio personalizzato oltre gli acceleratori AI Azure Maia e le CPU Azure Cobalt. Hanno introdotto Azure Integrated HSM, un chip di sicurezza interno progettato per migliorare la gestione delle chiavi senza compromettere le prestazioni. Nel 2025, Microsoft aggiungerà il modulo di sicurezza HSM in tutti i nuovi server del data center per proteggere i carichi di lavoro riservati e generici.

Microsoft ha anche introdotto Azure Boost DPU, la sua prima unità di elaborazione dati. Questo chip specializzato gestisce carichi di lavoro incentrati sui dati con un'efficienza eccezionale. I nuovi server con questa DPU ridurranno il consumo di energia di due terzi e avranno prestazioni quattro volte migliori rispetto ai server attuali.

Raffreddamento e infrastruttura energetica

Microsoft ha presentato il suo rack "sidekick" di raffreddamento a liquido di nuova generazione. Questa unità di scambio di calore può essere adattata nei data center di Azure per supportare sistemi AI su larga scala, tra cui l'infrastruttura GB200 di NVIDIA. Hanno anche collaborato con Meta su un design di rack di alimentazione disaggregato con alimentazione CC a 400 volt, consentendo fino al 35% in più di acceleratori AI in ogni rack server.

Nell'ambito di un progresso che coinvolge l'intero settore, Microsoft sta rendendo open source queste specifiche per rack di raffreddamento e alimentazione tramite l'Open Compute Project, consentendo all'intero settore di trarre vantaggio da queste innovazioni.

Infrastruttura informatica e intelligenza artificiale di prossima generazione

L'infrastruttura AI di Azure continua a evolversi con l'introduzione della serie di macchine virtuali ND H200 V5, dotata di GPU H200 di NVIDIA. La piattaforma ha mostrato notevoli miglioramenti delle prestazioni, superando lo standard di benchmarking del settore di un fattore due tra GPU NVIDIA H100 e H200.

Microsoft ha anche annunciato Azure ND GB200 v6, una nuova serie di VM ottimizzata per l'intelligenza artificiale che incorpora il design rack-scale NVIDIA GB200 NVL 72 con networking Quantum InfiniBand. Questo progresso consente prestazioni di supercomputing AI su larga scala, collegando decine di migliaia di GPU Blackwell.

Per il supercomputing basato su CPU, le nuove macchine virtuali Azure HBv5, basate su processori AMD EPYC™ 9V64H personalizzati, promettono prestazioni fino a otto volte più veloci rispetto alle alternative attuali e saranno disponibili per l'anteprima nel 2025.

Integrazione di Azure Container Apps e NVIDIA

Azure Container Apps ora supporta le GPU NVIDIA, consentendo una distribuzione AI semplificata e scalabile. Questa piattaforma di contenitori serverless semplifica la distribuzione e la gestione di applicazioni basate su microservizi, astraendo l'infrastruttura sottostante. Con la fatturazione al secondo e le funzionalità scale-to-zero, i clienti pagano solo per il calcolo che utilizzano, garantendo un utilizzo economico ed efficiente delle risorse.

La piattaforma NVIDIA AI su Azure include nuovi flussi di lavoro di riferimento per l'AI industriale e NVIDIA Omniverse Blueprint per la creazione di immagini immersive basate sull'AI. Un flusso di lavoro di riferimento per il monitoraggio remoto 3D delle operazioni industriali sarà presto disponibile, consentendo agli sviluppatori di collegare modelli 3D fisicamente accurati di sistemi industriali a dati in tempo reale da Azure IoT Operations e Power BI.

PC AI RTX e calcolo avanzato

NVIDIA ha annunciato il suo nuovo SLM multimodale, NVIDIA Nemovision-4B Instruct, per comprendere le immagini visive nel mondo reale e sullo schermo. Questa tecnologia, che sarà presto introdotta nei PC e nelle workstation RTX AI, migliorerà le interazioni umane digitali con maggiore realismo.

Gli aggiornamenti di NVIDIA TensorRT Model Optimizer (ModelOpt) offrono ora agli sviluppatori Windows un percorso migliorato per ottimizzare i modelli per la distribuzione di ONNX Runtime. Ciò consente agli sviluppatori di creare modelli AI per PC più rapidi e precisi quando accelerati da GPU RTX, semplificando al contempo la distribuzione nell'ecosistema PC con runtime ONNX.

Oltre 600 app e giochi Windows eseguono l'intelligenza artificiale in locale su oltre 100 milioni di PC GeForce RTX AI in tutto il mondo, offrendo prestazioni veloci, affidabili e a bassa latenza. La collaborazione tra NVIDIA e Microsoft continua a guidare l'innovazione nei dispositivi di elaborazione personale, offrendo sofisticate capacità di intelligenza artificiale agli utenti di tutti i giorni.

Microsoft Cloud e infrastruttura ibrida

L'impegno di Microsoft verso soluzioni multi-cloud e ibride è esemplificato da Azure Arc, che ora serve oltre 39,000 clienti in tutto il mondo. Il nuovo Azure Local offre un'infrastruttura ibrida sicura e connessa al cloud con opzioni flessibili, inclusi server GPU per l'inferenza AI.

Microsoft ha anche annunciato Windows Server 2025 e SQL Server 2025, sfruttando Azure Arc per offrire funzionalità cloud in ambienti on-premise e cloud. SQL Server 2025 si distingue per le sue nuove funzionalità AI integrate, semplificando lo sviluppo di applicazioni AI e modelli RAG con supporto vettoriale.

Conclusione

Le recenti innovazioni di Microsoft sottolineano la sua dedizione al progresso di silicio personalizzato, infrastrutture AI e soluzioni cloud ibride. Con sviluppi rivoluzionari come Azure Integrated HSM e Azure Boost DPU, Microsoft sta definendo un nuovo modello per operazioni di data center sicure, efficienti e ad alte prestazioni. L'introduzione di tecnologie di raffreddamento e alimentazione di nuova generazione e innovazioni open source evidenziano l'impegno di Microsoft nel promuovere la collaborazione e la sostenibilità del settore.

L'evoluzione dell'infrastruttura di elaborazione e intelligenza artificiale di Azure, tra cui le macchine virtuali ND H200 V5 e ND GB200 v6, dimostra la capacità di Microsoft di offrire prestazioni di intelligenza artificiale su larga scala. Nel frattempo, le nuove macchine virtuali HBv5 promettono prestazioni per il supercomputing basato su CPU, assicurando che Azure rimanga un leader nell'elaborazione ad alte prestazioni.

Infine, con le solide capacità ibride di Azure Arc e l'introduzione di strumenti potenziati dall'intelligenza artificiale come SQL Server 2025, Microsoft sta dotando le aziende di soluzioni flessibili e scalabili per affrontare le complessità dei carichi di lavoro moderni. Insieme, questi progressi consolidano la posizione di Microsoft come leader nel guidare il futuro dell'intelligenza artificiale, del cloud e dell'infrastruttura ibrida.

Interagisci con StorageReview

Newsletter | YouTube | Podcast iTunes / Spotify | Instagram | Twitter | TikTok | Feed RSS

Divyansh Jain

Ingegnere di Machine Learning, appassionato di homelab e di tecnologia. In StorageReview, mi occupo di test di intelligenza artificiale e carichi di lavoro emergenti, fornendo analisi e approfondimenti sulle prestazioni.