한계 주기
동역학 시스템에서 상태가 특정 궤적을 따라 주기적으로 반복되는 현상이다. 강화학습에서는 에이전트가 목표 상태에 정지하지 못하고 주변을 맴도는 국소 최적점(Local Optima) 문제로 나타나며, 이를 해결하기 위해 정교한 보상 설계가 필요하다.