뉴럴브릿지인증 기업
LLM 서빙·MLOps 엔지니어
데이터·ML정규직시니어(9년+)상주 · 서울 강남
7,500~10,500만원D-3
주요 업무
- vLLM 서빙 구성과 배치·동시성 튜닝
- 양자화와 모델 최적화, 손상 측정
- 학습·평가 파이프라인 운영
- GPU 비용 최적화
자격 요건
- 모델 서빙 운영 경험 3년 이상
- PyTorch와 CUDA 환경 이해
- Kubernetes 운영 경험
우대 사항
- LoRA 파인튜닝 경험
- 결정적 평가 하네스 구축 경험
- 비용 손익 분석 경험
상세 내용
무엇을 하는 자리인가
자체 모델 서빙 비용을 내리고 지연을 잡습니다. 벤치마크를 정직하게 측정하는 일이 핵심입니다.
규모
일 평균 요청 12만 건, GPU 8장 운용 중입니다.
기술 스택
PyTorchvLLM모델최적화서빙
회사 소개
뉴럴브릿지인증 기업
웹사이트 방문 ↗회사 소개
사내 문서 검색과 업무 에이전트를 제공하는 B2B SaaS 기업입니다. 제조·금융 고객사 40곳에서 운영 중입니다.
일하는 방식
주 2회 사무실 출근, 나머지는 자율. 배포는 하루 여러 번, 코드 리뷰는 24시간 안에 회신합니다.
연봉
지원하기7,500~10,500만원