AMD GPU에서 CUDA 앱을 돌리는 Windows 재현 스택 공개

CUDA for AMD on Windows

Speedstu가 ZLUDA와 AMD HIP/ROCm을 조합해 Windows에서 CUDA 기반 애플리케이션을 AMD GPU로 실행하는 재현 가능한 스택을 GitHub에 공개했다. 공식 ZLUDA v6-preview.69와 HIP SDK 6.4, LibTorch 2.3.0+cu118을 사용했으며, RX 9060 XT(gfx1200)에서 cuBLAS, cuSPARSE, cuFFT 등이 cuda_check를 통과하고 221만 파라미터 PPO 네트워크 학습이 완료됐다. 다만 cuDNN은 사용할 수 없고 검증된 GPU는 이 모델뿐이다.

이 통합 테스트는 원래 이 프로젝트를 시작하게 만든 것과 동일한 CUDA 기반 LibTorch 학습 워크로드를 사용했습니다.
  1. linuxhansl

    주제에서 벗어난 얘기이고 좀 푸념이긴 한데, 나는 우리 모두가 HIP, SYCL, OpenCL 같은 개방형 표준에 집중했으면 훨씬 좋겠다.

    대부분의 LLM 추론이 닫힌 H/W, 닫힌 드라이버, 닫힌 SDK에서 돌아간다는 건 견딜 수가 없다.

  2. swerner

    AI가 Nvidia의 해자를 무너뜨릴 것이다. CUDA/PTX를 HIP, SYCL, Metal로 변환하는 게 사소해지면, CUDA는 더 이상 해자가 아니라 중간 표현(intermediate representation)이 된다.

  3. lulzx

    그나저나 내가 cuda-metal을 만들었다 (맥용 ㅋㅋ), https://github.com/lulzx/cuda-metal

  4. Nurysso

    아 진짜, 내가 Nvidia GPU 있었을 때 CUDA를 얼마나 좋아했는지 말로 다 못 한다, ML이 훨씬 재밌었는데 AMD에서는 전쟁이야, 특히 내가 가진 RDNA 2 카드에서는 더 심하고. 언젠가는 CUDA를 AMD 대응 제품용으로 제대로 변환할 수 있게 되길 바란다

  5. latchkey

    이런 흥미로운 시도들도 있다:

    https://github.com/Zaneham/Booth

    https://scale-lang.com/

이 날의 다른 글

2026-09-13