reconstruction-vae
재구성 VAE
입력 영상이나 프레임을 잠재공간으로 인코딩한 뒤 원래 입력을 재구성하도록 학습되는 확률적 인코더·디코더 구조로, 본문에서는 프레임 간 동적 정보를 장기적으로 보존하지 못해 장기 예측에서 성능 저하를 유발하는 요소로 지목됐다. 재구성 손실만 최적화하면 시각적 세부는 보존되지만 행동 예측에 유용한 의미적 상태는 소실될 수 있다. 따라서 향후 예측 지평선이 길어질수록 재구성 중심의 잠재는 역량이 떨어지는 경향을 보인다.