Bilibili에서 개발한 Index-1.9B 시리즈 언어 모델
Index SLM Technical Report
Bilibili에서 개발한 Index-1.9B는 1.9억 개의 비임베딩 파라미터를 가진 네 가지 모델로 구성된다. Index-1.9B-Base는 2.8조 개의 주로 중국어와 영어 토큰으로 사전 학습된 기초 모델이다. Index-1.9B-Pure는 모든 지시형 데이터를 필터링하여 학습된 변형 모델이며, Index-1.9B-Chat은 감독된 미세 조정과 직접 선호 최적화를 통해 정렬된 모델이다. Index-1.9B-Character는 채팅 모델에 검색 증강 생성을 추가하여 역할 놀이 맞춤화를 지원한다. Index-1.9B-Base는 여러 표준 벤치마크에서 평균 64.92점을 기록하며, 그 크기의 몇 배에 달하는 오픈 모델과 경쟁력을 보인다. 모든 모델과 평가 코드는 https://github.com/bilibili/Index-1.9B에서 공개된다.
Index-1.9B-Base는 64.92점의 평균 점수를 기록하여, 대규모 모델과 경쟁할 수 있는 성능을 보여준다.
원문 출처
arXiv cs.CL (계산언어학·NLP)