Amazon SageMaker AI의 NVIDIA Nemotron 3 모델 서버리스 커스터마이징
Fine-tune NVIDIA Nemotron 3 models with Amazon SageMaker AI serverless model customization
Amazon SageMaker AI는 NVIDIA Nemotron 3 모델에 대한 서버리스 모델 커스터마이징을 도입했다. Nemotron 3 Nano(30B 총 파라미터, 3B 활성)와 Nemotron 3 Super(120B 총 파라미터, 12B 활성) 모델을 지원하며, 감독 학습(SFT), 검증 가능한 보상을 통한 강화 학습(RLVR), AI 피드백을 통한 강화 학습(RLAIF) 기법을 활용해 특정 도메인과 워크플로우에 맞게 조정할 수 있다. Nemotron 3은 하이브리드 Mamba-Transformer Mixture-of-Experts 아키텍처를 기반으로 하며, 최대 1M 토큰 컨텍스트 길이를 지원한다.
Nemotron 3 Nano는 4배 높은 처리량을 제공하며, 비용과 지연 시간이 중요한 고용량 멀티 에이전트 작업에 적합하다.
원문 출처
AWS Machine Learning Blog