결정론적 시뮬레이션
같은 초기 상태와 같은 행동 순서를 넣으면 동일한 결과가 나오는 환경입니다. 에이전트의 성능 변화를 무작위 환경 변화와 구분하고 실험을 반복 재현하는 데 사용됩니다.