본문으로 건너뛰기

multi-agent-reinforcement-learning

다중 에이전트 강화학습

여러 에이전트가 하나의 환경에서 상호작용하며 보상 신호를 바탕으로 행동 전략을 최적화하는 학습 방식입니다. 공급망에서는 운송 경로와 재고 같은 서로 연결된 결정을 여러 주체가 조정하는 문제와 연결됩니다.