본문으로 건너뛰기

Value Function

가치 함수

강화학습에서 특정 상태나 행동이 미래에 가져다줄 기대 보상의 총합을 예측하는 함수로, 현재 상황의 유리함을 평가하는 척도가 된다.