REFACTOR-VLA: 비지도 학습을 통한 타입화된 모터 프로그램 라이브러리
REFACTOR-VLA: Unsupervised Library Learning of Typed Motor Programs
현재의 비전-언어-행동(VLA) 모델인 OpenVLA, π0, RT-2, RDT-1B는 '모놀리식' 구조로, 원시 모터 명령이나 짧은 행동 시퀀스를 생성하며, 재사용 가능한 추상화로 행동을 조직하지 않는다. 이로 인해 장기 과제에서 성능이 저하되고 학습한 내용을 해석하기 어렵다. 기존 기술 발견 접근법은 두 행동 시퀀스가 '행동적으로 동등한지' 결정하는 핵심 문제를 회피하는 경향이 있다.
원문 출처
Apple Machine Learning Research