SupremeRAID™ GPU 가속 RAID 성능 평가
GP-SPARK 직결 환경에서 SupremeRAID™, Linux MD RAID, 단일 NVMe-oF의 성능 비교
핵심 결과: 패리티 RAID에서의 SupremeRAID™ 우위
RAID 5 / RAID 6 쓰기 성능에서 SupremeRAID™(GPU 오프로드)는 MDRAID(CPU 소프트웨어 RAID)를 크게 앞섭니다.
RAID 5 순차 쓰기
Intel 머신
4.4×
DGX Spark
6.6×
RAID 6 순차 쓰기
Intel 머신
4.5×
DGX Spark
5.7×
RAID 5 랜덤 쓰기
Intel 머신
8.4×
DGX Spark
6.4×
RAID 6 랜덤 쓰기
Intel 머신
5.7×
DGX Spark
5.1×
수치는 MDRAID 처리량 대비 SupremeRAID™의 배수입니다.
패리티 연산을 GPU로 오프로드함으로써, CPU가 병목이 되는 RAID 5/6에서 MDRAID가 겪는 쓰기 성능 저하를 크게 완화합니다.
순차 쓰기 대역폭 비교
동일 RAID 레벨에서 SupremeRAID™와 MDRAID를 직접 비교. 단위 MB/s, bs=2M, numjobs=40, iodepth=32, 패턴당 60초.
SupremeRAID™
MDRAID
그래프는 패리티 구성인 RAID 5 / RAID 6만 다룹니다. RAID 0과 단일 NVMe 구성은 아래 표를 참고하세요.
성능 요약 (순차, MB/s)
| 구성 | Intel 읽기 | Intel 쓰기 | DGX 읽기 | DGX 쓰기 |
|---|---|---|---|---|
| SupremeRAID™ RAID 0 | 8080 | 4731 | 7805 | 4804 |
| SupremeRAID™ RAID 5 | 7906 | 2926 | 7725 | 2930 |
| SupremeRAID™ RAID 6 | 8129 | 2389 | 7687 | 1964 |
| MDRAID RAID 0 | 7990 | 4811 | 7401 | 4821 |
| MDRAID RAID 5 | 7202 | 660 | 7399 | 446 |
| MDRAID RAID 6 | 7280 | 536 | 7467 | 343 |
| Single NVMe-oF | 2060 | 1448 | 1923 | 1438 |
| Single NVMe (Local) | 6302 | 2402 | 11700 | 12700 |
RAID 0은 패리티 연산이 없어 두 방식이 거의 대등하지만, RAID 5/6에서는 SupremeRAID™의 우위가 뚜렷해집니다.
dd 처리량 교차 검증
100 GiB 파일 쓰기 5회 실행, 정상 상태(2~5회차) 평균값(GB/s)으로 fio 경향을 검증합니다.
| 구성 | SupremeRAID™ | MDRAID |
|---|---|---|
| RAID 5 | ≈ 2.95 – 3.00 GB/s | ≈ 0.85 – 1.60 GB/s |
| RAID 6 | ≈ 2.00 – 2.13 GB/s | ≈ 0.76 – 1.35 GB/s |
수치는 원본 리포트 그래프에서 읽어낸 근사값으로 두 테스트 환경의 범위를 나타내며, 경향 참고용입니다.
GP-SPARK - 테스트 환경
Intel 머신 환경
- CPU
- Intel Xeon Platinum 8380 ×2 (소켓당 40코어, 2.30 GHz)
- 메모리
- 256 GB
- OS 드라이브
- 1.92 TB NVMe SSD
- GPU
- NVIDIA A40 (Driver 610.43.02)
- 연결 방식
- GP-SPARK 직결
- 운영체제
- Ubuntu 24.04.4
DGX Spark 환경
- CPU
- NVIDIA Cortex-X925 3.9 GHz (10코어)
- 메모리
- 128 GB (통합 메모리)
- OS 드라이브
- 4 TB NVMe SSD
- GPU
- NVIDIA GB10 (Driver 580.159.03)
- 연결 방식
- GP-SPARK 직결
- 운영체제
- Ubuntu 24.04.4
GP-SPARK - 측정 방법
fio 벤치마크
- I/O 엔진
- libaio (direct=1)
- 블록 크기
- 2 MiB
- 파일 크기
- 20 GiB / job
- 병렬 작업 수
- 40
- I/O 큐 깊이
- 32
- 실행 시간
- 패턴당 60초 (사이에 30초 쿨다운)
- 측정 패턴
- seq_write / rand_write / seq_read / rand_read
dd 처리량 테스트
- 명령어
- dd if=/dev/zero of=/data/data-N.dat bs=1M count=100K
- 1회 전송량
- 100 GiB / 회
- 반복 횟수
- 연속 5회
- 집계 방식
- 정상 상태(2~5회차) 평균
측정 구성 (두 환경 모두 실시)
- SupremeRAID™ RAID 0 / 5 / 6 (GPU 가속 RAID)
- Linux MD RAID 0 / 5 / 6 (소프트웨어 RAID)
- 단일 NVMe-oF (비교 기준)
- 단일 NVMe (로컬 디스크, 참고용)
참고 사항
- 위 수치는 HPCTECH Corporation의 리포트 「SupremeRAID™ GPU-Accelerated RAID Performance Evaluation」에 근거합니다.
- 실제 성능은 호스트 플랫폼, SSD 모델, 네트워크 구성, OS 튜닝에 따라 달라집니다.
- 고객사 환경에서의 PoC 진행이나 전체 테스트 리포트가 필요하시면 언제든 문의해 주세요.