multi-agent-reinforcement-learning
다중 에이전트 강화학습
여러 에이전트가 하나의 환경에서 상호작용하며 보상 신호를 바탕으로 행동 전략을 최적화하는 학습 방식입니다. 공급망에서는 운송 경로와 재고 같은 서로 연결된 결정을 여러 주체가 조정하는 문제와 연결됩니다.
다중 에이전트 강화학습
여러 에이전트가 하나의 환경에서 상호작용하며 보상 신호를 바탕으로 행동 전략을 최적화하는 학습 방식입니다. 공급망에서는 운송 경로와 재고 같은 서로 연결된 결정을 여러 주체가 조정하는 문제와 연결됩니다.