SupremeRAID™ GPU アクセラレーション RAID パフォーマンス評価
GP-SPARK 直結環境における SupremeRAID™、Linux MD RAID、シングル NVMe-oF の性能比較
主要な結果:パリティ RAID における SupremeRAID™ の優位性
RAID 5 / RAID 6 のライト性能では、SupremeRAID™(GPU オフロード)が MDRAID(CPU ソフトウェア RAID)を大きく上回ります。
RAID 5 シーケンシャルライト
Intel マシン
4.4×
DGX Spark
6.6×
RAID 6 シーケンシャルライト
Intel マシン
4.5×
DGX Spark
5.7×
RAID 5 ランダムライト
Intel マシン
8.4×
DGX Spark
6.4×
RAID 6 ランダムライト
Intel マシン
5.7×
DGX Spark
5.1×
数値は MDRAID のスループットに対する SupremeRAID™ の倍率です。
パリティ演算を GPU にオフロードすることで、CPU がボトルネックとなる RAID 5/6 における MDRAID のライト性能低下を大幅に抑制します。
シーケンシャルライト帯域の比較
同一 RAID レベルでの SupremeRAID™ と MDRAID の直接比較。単位 MB/s、bs=2M、numjobs=40、iodepth=32、パターンごとに 60 秒。
SupremeRAID™
MDRAID
グラフはパリティ構成の RAID 5/RAID 6 のみを対象としています。RAID 0 およびシングル NVMe の各構成は下表をご参照ください。
性能サマリー(シーケンシャル、MB/s)
| 構成 | Intel リード | Intel ライト | DGX リード | DGX ライト |
|---|---|---|---|---|
| SupremeRAID™ RAID 0 | 8080 | 4731 | 7805 | 4804 |
| SupremeRAID™ RAID 5 | 7906 | 2926 | 7725 | 2930 |
| SupremeRAID™ RAID 6 | 8129 | 2389 | 7687 | 1964 |
| MDRAID RAID 0 | 7990 | 4811 | 7401 | 4821 |
| MDRAID RAID 5 | 7202 | 660 | 7399 | 446 |
| MDRAID RAID 6 | 7280 | 536 | 7467 | 343 |
| Single NVMe-oF | 2060 | 1448 | 1923 | 1438 |
| Single NVMe (Local) | 6302 | 2402 | 11700 | 12700 |
RAID 0 はパリティ演算がないため両者はほぼ同等ですが、RAID 5/6 では SupremeRAID™ の優位性が顕著になります。
dd スループットによるクロス検証
100 GiB のファイル書き込みを 5 回実行し、定常状態(2〜5 回目)の平均値(GB/s)で fio の傾向を検証しています。
| 構成 | SupremeRAID™ | MDRAID |
|---|---|---|
| RAID 5 | ≈ 2.95 – 3.00 GB/s | ≈ 0.85 – 1.60 GB/s |
| RAID 6 | ≈ 2.00 – 2.13 GB/s | ≈ 0.76 – 1.35 GB/s |
数値は元レポートのグラフから読み取った概算値で、2 つのテスト環境の範囲を示します。傾向の参考としてご覧ください。
GP-SPARK - テスト環境
Intel マシン環境
- CPU
- Intel Xeon Platinum 8380 ×2(1 ソケットあたり 40 コア、2.30 GHz)
- メモリ
- 256 GB
- OS ドライブ
- 1.92 TB NVMe SSD
- GPU
- NVIDIA A40 (Driver 610.43.02)
- 接続方式
- GP-SPARK に直結
- OS
- Ubuntu 24.04.4
DGX Spark 環境
- CPU
- NVIDIA Cortex-X925 3.9 GHz(10 コア)
- メモリ
- 128 GB(ユニファイドメモリ)
- OS ドライブ
- 4 TB NVMe SSD
- GPU
- NVIDIA GB10 (Driver 580.159.03)
- 接続方式
- GP-SPARK に直結
- OS
- Ubuntu 24.04.4
GP-SPARK - 測定方法
fio ベンチマーク
- I/O エンジン
- libaio (direct=1)
- ブロックサイズ
- 2 MiB
- ファイルサイズ
- 20 GiB / job
- 並列ジョブ数
- 40
- I/O デプス
- 32
- 実行時間
- パターンごとに 60 秒(間に 30 秒のクールダウン)
- 測定パターン
- seq_write / rand_write / seq_read / rand_read
dd スループットテスト
- コマンド
- dd if=/dev/zero of=/data/data-N.dat bs=1M count=100K
- 1 回あたりの転送量
- 100 GiB / 回
- 実行回数
- 連続 5 回
- 集計方法
- 定常状態(2〜5 回目)の平均
測定した構成(両環境とも実施)
- SupremeRAID™ RAID 0 / 5 / 6(GPU アクセラレーション RAID)
- Linux MD RAID 0 / 5 / 6(ソフトウェア RAID)
- シングル NVMe-oF(比較基準)
- シングル NVMe(ローカルディスク、参考値)
注記
- 上記の数値は HPCTECH Corporation のレポート「SupremeRAID™ GPU-Accelerated RAID Performance Evaluation」に基づいています。
- 実際の性能はホストプラットフォーム、SSD の型番、ネットワーク構成、OS のチューニングにより異なります。
- お客様の環境での PoC 実施や詳細なテストレポートをご希望の場合は、お気軽にお問い合わせください。