ncnn Vulkan 백엔드를 활용한 ML 모델의 성능 개선
Vendor-agnostic ML inference on production edge devices [R]
PostSlate는 비디오 편집 도구로, 다양한 GPU 환경에서 ML 모델을 실행하기 위해 ncnn의 Vulkan 백엔드를 사용하고 있다. ArcFace R50 모델의 경우, ONNX CPU에서 30ms에서 ncnn Vulkan로 3ms로 성능이 향상되었고, SCRFD 모델은 25ms에서 2.5ms로 개선되었다. ArcFace 모델의 크기는 ONNX fp32에서 174MB에서 ncnn fp16으로 87MB로 줄어들었다. Vulkan 드라이버는 모든 기기에 존재하여 사용자에게 특정 런타임을 강제할 필요가 없다.
ncnn Vulkan 백엔드를 통해 다양한 GPU 환경에서 ML 모델의 성능을 크게 개선할 수 있다.
원문 출처
r/MachineLearning