모델이 AI의 다음 훈련 데이터셋이 되는 이유
Why Models Are AI’s Next Training Dataset with Damian Borth - #772
AI는 지난 10년간 점점 더 큰 모델을 더 큰 데이터셋으로 훈련시키며 발전해왔다. 그러나 고품질 훈련 데이터를 찾기 어려워지고 사전 훈련 비용이 증가함에 따라, 연구자들은 기초 모델의 개선을 위한 새로운 방법을 모색하고 있다. 다미안 보르트 교수는 이미 훈련된 모델을 중요한 지식의 원천으로 간과해왔음을 지적하며, 그의 연구팀은 훈련된 신경망을 데이터로 활용하는 '가중치 공간 학습'을 개발했다. 이 방법은 매번 원시 데이터에서 시작하는 대신 수백만 시간의 GPU 최적화 결과에서 학습한다. 이는 전문 모델 개발 비용을 크게 줄일 수 있는 가능성을 제시한다.
가중치 공간 학습은 훈련된 신경망을 데이터로 활용하여 비용을 절감할 수 있는 방법이다.
원문 출처
The TWIML AI Podcast