prismBETA
← 개발자 브리핑
2026-09-07 · 07 / 07

AMD GPU에서 CUDA 실행 — ZLUDA+ROCm 재현 스택

ZLUDA와 AMD HIP/ROCm을 엮어 NVIDIA CUDA용 Windows 프로그램을 AMD GPU에서 돌리는 설치·진단·실행 스크립트 프로젝트. Radeon RX 9060 XT(gfx1200)에서 약 220만 파라미터 PPO 네트워크의 추론·학습을 비공개 DLL 없이 공식 배포물만으로 완료했고, cuda_check에서 cuBLAS·cuSPARSE·cuFFT가 통과함. 다만 검증 환경엔 cuDNN이 없어 합성곱 중심 모델은 동작하지 않을 수 있고, 현재 검증된 GPU는 RX 9060 XT뿐임.

실행 경로는 CUDA 애플리케이션 → ZLUDA → cuBLAS/cuSPARSE/cuFFT 호환 계층 → rocBLAS/hipBLASLt/rocSPARSE/HIP → AMD GPU로 이어짐. 검증 기준은 ZLUDA v6-preview.69와 LibTorch 2.3.0+cu118, HIP SDK 6.4이며 SHA-256 해시로 배포물을 확인함.

검증 반복 한 회에서 65,536 타임스텝을 처리했고, 2026-09-13 통제 A/B 테스트에서는 공식 업스트림 구성의 전체 처리량 중앙값이 초당 13,278스텝이었음. 다만 안정판 Windows HIP SDK에는 MIOpen 등 전체 ROCm AI 라이브러리 스택이 없어 cuDNN을 쓸 수 없고, 검증된 PPO 워크로드도 cuDNN 없이 완료된 GEMM 중심 작업임. 다른 AMD GPU는 자동 감지되더라도 실행이 보장되지 않으므로 대체 스택 도입 전 지원 범위를 확인해야 함.

투표
ML 워크로드, NVIDIA 외 GPU 고려하세요?
이 글이 도움이 되셨나요?
매주 월요일 아침 갱신 · 요약은 AI가 생성하며 출처 원문을 확인하세요.