SupremeRAID™ GPU アクセラレーション RAID パフォーマンス評価

GP-SPARK 直結環境における SupremeRAID™、Linux MD RAID、シングル NVMe-oF の性能比較

主要な結果:パリティ RAID における SupremeRAID™ の優位性

RAID 5 / RAID 6 のライト性能では、SupremeRAID™(GPU オフロード)が MDRAID(CPU ソフトウェア RAID)を大きく上回ります。

RAID 5 シーケンシャルライト
Intel マシン 4.4×
DGX Spark 6.6×
RAID 6 シーケンシャルライト
Intel マシン 4.5×
DGX Spark 5.7×
RAID 5 ランダムライト
Intel マシン 8.4×
DGX Spark 6.4×
RAID 6 ランダムライト
Intel マシン 5.7×
DGX Spark 5.1×

数値は MDRAID のスループットに対する SupremeRAID™ の倍率です。

パリティ演算を GPU にオフロードすることで、CPU がボトルネックとなる RAID 5/6 における MDRAID のライト性能低下を大幅に抑制します。

シーケンシャルライト帯域の比較

同一 RAID レベルでの SupremeRAID™ と MDRAID の直接比較。単位 MB/s、bs=2M、numjobs=40、iodepth=32、パターンごとに 60 秒。

SupremeRAID™ MDRAID
RAID 5 · Intel マシン
2926
660
RAID 5 · DGX Spark
2930
446
RAID 6 · Intel マシン
2389
536
RAID 6 · DGX Spark
1964
343

グラフはパリティ構成の RAID 5/RAID 6 のみを対象としています。RAID 0 およびシングル NVMe の各構成は下表をご参照ください。

性能サマリー(シーケンシャル、MB/s)

構成 Intel リード Intel ライト DGX リード DGX ライト
SupremeRAID™ RAID 0 8080 4731 7805 4804
SupremeRAID™ RAID 5 7906 2926 7725 2930
SupremeRAID™ RAID 6 8129 2389 7687 1964
MDRAID RAID 0 7990 4811 7401 4821
MDRAID RAID 5 7202 660 7399 446
MDRAID RAID 6 7280 536 7467 343
Single NVMe-oF 2060 1448 1923 1438
Single NVMe (Local) 6302 2402 11700 12700

RAID 0 はパリティ演算がないため両者はほぼ同等ですが、RAID 5/6 では SupremeRAID™ の優位性が顕著になります。

dd スループットによるクロス検証

100 GiB のファイル書き込みを 5 回実行し、定常状態(2〜5 回目)の平均値(GB/s)で fio の傾向を検証しています。

構成 SupremeRAID™ MDRAID
RAID 5 ≈ 2.95 – 3.00 GB/s ≈ 0.85 – 1.60 GB/s
RAID 6 ≈ 2.00 – 2.13 GB/s ≈ 0.76 – 1.35 GB/s

数値は元レポートのグラフから読み取った概算値で、2 つのテスト環境の範囲を示します。傾向の参考としてご覧ください。

GP-SPARK - テスト環境

Intel マシン環境
CPU
Intel Xeon Platinum 8380 ×2(1 ソケットあたり 40 コア、2.30 GHz)
メモリ
256 GB
OS ドライブ
1.92 TB NVMe SSD
GPU
NVIDIA A40 (Driver 610.43.02)
接続方式
GP-SPARK に直結
OS
Ubuntu 24.04.4
DGX Spark 環境
CPU
NVIDIA Cortex-X925 3.9 GHz(10 コア)
メモリ
128 GB(ユニファイドメモリ)
OS ドライブ
4 TB NVMe SSD
GPU
NVIDIA GB10 (Driver 580.159.03)
接続方式
GP-SPARK に直結
OS
Ubuntu 24.04.4

GP-SPARK - 測定方法

fio ベンチマーク
I/O エンジン
libaio (direct=1)
ブロックサイズ
2 MiB
ファイルサイズ
20 GiB / job
並列ジョブ数
40
I/O デプス
32
実行時間
パターンごとに 60 秒(間に 30 秒のクールダウン)
測定パターン
seq_write / rand_write / seq_read / rand_read
dd スループットテスト
コマンド
dd if=/dev/zero of=/data/data-N.dat bs=1M count=100K
1 回あたりの転送量
100 GiB / 回
実行回数
連続 5 回
集計方法
定常状態(2〜5 回目)の平均

測定した構成(両環境とも実施)

  • SupremeRAID™ RAID 0 / 5 / 6(GPU アクセラレーション RAID)
  • Linux MD RAID 0 / 5 / 6(ソフトウェア RAID)
  • シングル NVMe-oF(比較基準)
  • シングル NVMe(ローカルディスク、参考値)

注記

  • 上記の数値は HPCTECH Corporation のレポート「SupremeRAID™ GPU-Accelerated RAID Performance Evaluation」に基づいています。
  • 実際の性能はホストプラットフォーム、SSD の型番、ネットワーク構成、OS のチューニングにより異なります。
  • お客様の環境での PoC 実施や詳細なテストレポートをご希望の場合は、お気軽にお問い合わせください。