GPU 인프라 작업 문서화 시작
Kicking off GPU Mode [D]
GPU 인프라, LLMs, CV에 대한 작업을 문서화하는 시리즈를 시작한다. 첫 번째 글에서는 GPU가 산업의 중심인 이유, CPU와 GPU의 차이, 문제 발생 시 확인해야 할 첫 번째 장소인 `nvidia-smi`에 대해 간략히 설명한다. 이후에는 Ampere, Hopper, Blackwell 간의 경험적 아키텍처 차이, 커스텀 커널에서의 레지스터 압력 처리, 비동기 메모리 패러다임(TMA/wgmma)에 대해 다룰 예정이다.
원문 출처
r/MachineLearning