Qwen3.8-Flash-Next: 멀티모달 MoE 모델
Qwen3.8-Flash-Next
Qwen에서 공개한 Qwen3.8-Flash-Next는 멀티모달 MoE 모델로, Qwen4의 아키텍처를 미리 보여준다. 이 모델은 125B 토큰을 가지고 있지만, 6B 활성화로 성능 향상을 이룬다. 현재 DGX Spark에서 Unsloth 양자화 모델을 사용해 테스트 중이며, 72.5GB UD-IQ1_S와 78.9GB UD-Q2_K_XL 모델을 시도해 보았다.
원문 출처
Simon Willison's Weblog