StorageReview.com

DataFusion 仮想データベースのメモリ パフォーマンス ベンチマーク

DataFusion は、最も困難なデータ要件を処理できる柔軟性と拡張性を備えたエンタープライズ インメモリ仮想データベースまたはデータ ウェアハウスです。拡張された SQL92 命令セットにより、既存の場所からの異種ソース データを直接集約できます。これにより、組織は大規模で高価なデータ ウェアハウス プロジェクトを必要とせずに、既存の資産を活用して新しい要件に対応できるようになります。 DataFusion は、高レベルのデータ圧縮と高度な実行戦略により、優れたクエリ パフォーマンスを実現するハードウェア ライト ルートを提供します。業界標準とカスタム分析のシームレスな統合により、組織は最も要求の厳しい動的な状況を迅速に評価できるようになります。高性能、迅速な導入、高可用性を実現する完全な機能を備えた DataFusion は、あらゆる「機敏な組織」にとって貴重な資産です。

金融サービス、公共部門、量販店を含むあらゆる業界の大規模データ集約型組織は、「ビッグ データ」の課題に直面しているあらゆる企業を支援する DataFusion の独自のアーキテクチャから恩恵を受けることができます。ソリューションの例には、リアルタイムの意思決定サポート、リスク管理、規制報告、複数の管轄区域または法人にわたるデータ集約を必要とするサプライ チェーンの最適化などが含まれます。

DataFusion ベンチマーク

  • DataFusion ベンチマークは、ハードウェア構成を評価するために Stream Financial によって開発され、DataFusion リリース中に採用される一連のパフォーマンス テストの一部として使用されます。
  • DataFusion は複数のアーキテクチャにわたってクエリを実行できますが、このベンチマークは、1Tn 行×13 列のテーブルに対する単純な「where and group-by」であり、インデックスを作成せずに「総当たり」で実行されます。
  • 兆行のデータ テーブルは、DataFusion のネイティブ形式でディスクに事前に保存されます。
  • マルチチャネルまたは混合ストレージから最大のパフォーマンスを実現するために、DataFusion は、複数のマウントにまたがって大規模なテーブルをストライピングし、異なる IO マルチプライヤーを使用してこれらのマウント間でラウンドロビンを実行して、利用可能なすべてのストレージのパフォーマンスを最大限に活用します。
  • DataFusion は、IO とメモリの両方の使用を最適化しながら、これらの大規模なクエリの実行を複数の CPU とマシンに分散できます。
  • 最大のベンチマーク パフォーマンスを達成するために、DataFusion にはストレージ パフォーマンスまたは CPU を個別に追加できる柔軟性があります。これにより、サーバーとストレージの両方がその能力を最大限に活用できるようになります。