StorageReview.com

Benchmark delle prestazioni della memoria del database virtuale DataFusion

DataFusion è un database virtuale in memoria o data warehouse aziendale che offre la flessibilità e la scalabilità necessarie per gestire i requisiti di dati più impegnativi. Il suo set esteso di istruzioni SQL92 consente l'aggregazione diretta di dati di origine disparati da posizioni esistenti. Ciò consente alle organizzazioni di sfruttare le risorse esistenti e soddisfare nuovi requisiti senza la necessità di progetti di data warehouse grandi e costosi. Con livelli elevati di compressione dei dati e strategie di esecuzione avanzate, DataFusion offre un percorso hardware leggero verso prestazioni di query eccezionali. La perfetta integrazione di analisi standard e personalizzate del settore offre alle organizzazioni la capacità di valutare rapidamente le situazioni più impegnative e dinamiche. Completo di funzionalità per prestazioni elevate, implementazione rapida e alta disponibilità, DataFusion è una risorsa preziosa per qualsiasi "organizzazione agile".

Le grandi organizzazioni ad alta intensità di dati in tutti i settori, compresi i servizi finanziari, il settore pubblico e i distributori di volumi, possono trarre vantaggio dall’architettura unica di DataFusion che aiuterà qualsiasi azienda ad affrontare la sfida dei “Big Data”. Le soluzioni di esempio includono supporto decisionale in tempo reale, gestione del rischio, reporting normativo e ottimizzazione della catena di fornitura che richiede l'aggregazione dei dati tra più giurisdizioni o entità legali.

Benchmark DataFusion

  • Il benchmark DataFusion è stato sviluppato da Stream Financial per valutare le configurazioni hardware e viene utilizzato come parte di una serie di test delle prestazioni utilizzati durante i rilasci di DataFusion.
  • Sebbene DataFusion possa eseguire query su più architetture, questo benchmark è un semplice "dove e raggruppa per" su una tabella di 1Tn righe per 13 colonne che viene eseguito "a forza bruta" senza indicizzazione.
  • La tabella dati di trilioni di righe è pre-archiviata su disco/i nel formato nativo di DataFusion.
  • Per ottenere le massime prestazioni dall'archiviazione multicanale o anche mista, DataFusion può eseguire lo striping di tabelle di grandi dimensioni su più montaggi e il round robin su questi montaggi con diversi moltiplicatori IO per sfruttare al meglio tutte le prestazioni di archiviazione disponibili.
  • DataFusion può distribuire l'esecuzione di queste query di grandi dimensioni su più CPU e macchine, ottimizzando al tempo stesso l'utilizzo sia dell'I/O che della memoria.
  • Per ottenere le massime prestazioni di riferimento, DataFusion ha la flessibilità di aggiungere prestazioni di archiviazione o CPU in modo indipendente. Ciò garantisce che sia i server che lo spazio di archiviazione vengano utilizzati al massimo delle loro capacità.