참고X
세계-행동 모델 'Dyna-2', 100만 시간 이상의 1인칭 인간 비디오 학습 공개
로보틱스 학습의 핵심이 될 대규모 egocentric 비디오 데이터셋 학습 모델의 등장.
요약
Dyna-2는 100만 시간 이상의 1인칭 시점(egocentric) 인간 비디오 데이터를 학습한 '월드 액션 모델(world-action model)'이다. 기존 모델들과 달리 인간의 1인칭 경험을 직접적인 학습 데이터로 활용했다는 점이 특징이다. 향후 이러한 방식의 데이터 스케일링이 지속될 경우, 인간의 경험 데이터는 로봇공학 분야에서 가장 방대한 데이터셋 중 하나가 될 것으로 전망된다. 이번 발표는 로봇 학습을 위한 데이터 소스로서 1인칭 인간 비디오가 가지는 잠재력을 시사한다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @manishkhosiya: Dyna-2 is a world-action model trained on over 1M hours of egocentric human video. It learned from 1M+ hours of human first-person
원문 보기 ↗