SupremeRAID™ GPU 가속 RAID 성능 평가

GP-SPARK 직결 환경에서 SupremeRAID™, Linux MD RAID, 단일 NVMe-oF의 성능 비교

핵심 결과: 패리티 RAID에서의 SupremeRAID™ 우위

RAID 5 / RAID 6 쓰기 성능에서 SupremeRAID™(GPU 오프로드)는 MDRAID(CPU 소프트웨어 RAID)를 크게 앞섭니다.

RAID 5 순차 쓰기
Intel 머신 4.4×
DGX Spark 6.6×
RAID 6 순차 쓰기
Intel 머신 4.5×
DGX Spark 5.7×
RAID 5 랜덤 쓰기
Intel 머신 8.4×
DGX Spark 6.4×
RAID 6 랜덤 쓰기
Intel 머신 5.7×
DGX Spark 5.1×

수치는 MDRAID 처리량 대비 SupremeRAID™의 배수입니다.

패리티 연산을 GPU로 오프로드함으로써, CPU가 병목이 되는 RAID 5/6에서 MDRAID가 겪는 쓰기 성능 저하를 크게 완화합니다.

순차 쓰기 대역폭 비교

동일 RAID 레벨에서 SupremeRAID™와 MDRAID를 직접 비교. 단위 MB/s, bs=2M, numjobs=40, iodepth=32, 패턴당 60초.

SupremeRAID™ MDRAID
RAID 5 · Intel 머신
2926
660
RAID 5 · DGX Spark
2930
446
RAID 6 · Intel 머신
2389
536
RAID 6 · DGX Spark
1964
343

그래프는 패리티 구성인 RAID 5 / RAID 6만 다룹니다. RAID 0과 단일 NVMe 구성은 아래 표를 참고하세요.

성능 요약 (순차, MB/s)

구성 Intel 읽기 Intel 쓰기 DGX 읽기 DGX 쓰기
SupremeRAID™ RAID 0 8080 4731 7805 4804
SupremeRAID™ RAID 5 7906 2926 7725 2930
SupremeRAID™ RAID 6 8129 2389 7687 1964
MDRAID RAID 0 7990 4811 7401 4821
MDRAID RAID 5 7202 660 7399 446
MDRAID RAID 6 7280 536 7467 343
Single NVMe-oF 2060 1448 1923 1438
Single NVMe (Local) 6302 2402 11700 12700

RAID 0은 패리티 연산이 없어 두 방식이 거의 대등하지만, RAID 5/6에서는 SupremeRAID™의 우위가 뚜렷해집니다.

dd 처리량 교차 검증

100 GiB 파일 쓰기 5회 실행, 정상 상태(2~5회차) 평균값(GB/s)으로 fio 경향을 검증합니다.

구성 SupremeRAID™ MDRAID
RAID 5 ≈ 2.95 – 3.00 GB/s ≈ 0.85 – 1.60 GB/s
RAID 6 ≈ 2.00 – 2.13 GB/s ≈ 0.76 – 1.35 GB/s

수치는 원본 리포트 그래프에서 읽어낸 근사값으로 두 테스트 환경의 범위를 나타내며, 경향 참고용입니다.

GP-SPARK - 테스트 환경

Intel 머신 환경
CPU
Intel Xeon Platinum 8380 ×2 (소켓당 40코어, 2.30 GHz)
메모리
256 GB
OS 드라이브
1.92 TB NVMe SSD
GPU
NVIDIA A40 (Driver 610.43.02)
연결 방식
GP-SPARK 직결
운영체제
Ubuntu 24.04.4
DGX Spark 환경
CPU
NVIDIA Cortex-X925 3.9 GHz (10코어)
메모리
128 GB (통합 메모리)
OS 드라이브
4 TB NVMe SSD
GPU
NVIDIA GB10 (Driver 580.159.03)
연결 방식
GP-SPARK 직결
운영체제
Ubuntu 24.04.4

GP-SPARK - 측정 방법

fio 벤치마크
I/O 엔진
libaio (direct=1)
블록 크기
2 MiB
파일 크기
20 GiB / job
병렬 작업 수
40
I/O 큐 깊이
32
실행 시간
패턴당 60초 (사이에 30초 쿨다운)
측정 패턴
seq_write / rand_write / seq_read / rand_read
dd 처리량 테스트
명령어
dd if=/dev/zero of=/data/data-N.dat bs=1M count=100K
1회 전송량
100 GiB / 회
반복 횟수
연속 5회
집계 방식
정상 상태(2~5회차) 평균

측정 구성 (두 환경 모두 실시)

  • SupremeRAID™ RAID 0 / 5 / 6 (GPU 가속 RAID)
  • Linux MD RAID 0 / 5 / 6 (소프트웨어 RAID)
  • 단일 NVMe-oF (비교 기준)
  • 단일 NVMe (로컬 디스크, 참고용)

참고 사항

  • 위 수치는 HPCTECH Corporation의 리포트 「SupremeRAID™ GPU-Accelerated RAID Performance Evaluation」에 근거합니다.
  • 실제 성능은 호스트 플랫폼, SSD 모델, 네트워크 구성, OS 튜닝에 따라 달라집니다.
  • 고객사 환경에서의 PoC 진행이나 전체 테스트 리포트가 필요하시면 언제든 문의해 주세요.