Danijar Hafner의 AI 에이전트 개발과 모델 기반 강화 학습
This AI entrepreneur is developing agents that can plan ahead for the unexpected
Danijar Hafner는 샌프란시스코의 신생 스타트업에서 AI가 훈련되지 않은 환경을 탐색할 수 있도록 하는 작업을 계속하고 있다. 그는 중국에서 수입한 휴머노이드를 사용하여 이러한 기술을 물리적으로 구현하고 있으며, 모델 기반 강화 학습을 통해 AI 모델을 개발하고 있다. 그의 Dreamer 시리즈는 Atari 2600 게임에서 인간 수준의 성능을 달성했으며, Dreamer 4는 오프라인 데이터 세트를 통해 다이아몬드를 채굴하는 방법을 학습했다. 현재 그는 새로운 스타트업을 운영하며, 2025년 가을에 Google DeepMind를 떠났다.
Hafner의 모델 기반 강화 학습은 AI가 훈련되지 않은 환경에서도 복잡한 작업을 수행할 수 있도록 한다.
원문 출처
MIT Technology Review — AI