관련 기사 바로가기
Windows에서 MuJoCo, Gymnasium, PyTorch, SB3, TensorBoard 설정하는 방법행동 복제(Behavior Cloning)를 이용해 스트리트 파이터 6 플레이를 학습하는 AI 구현전기차 배터리 열 관리 시스템을 위한 강화학습 및 MPC 제어 전략 비교 연구Stable Baselines3(SB3)와 트랜스포머를 이용한 포트폴리오 최적화 PPO 정책 구현 및 학습 불안정성 문제Super Mario Bros를 플레이하는 PPO 에이전트 학습 프로젝트 공유파이썬으로 처음부터 직접 만든, 스스로 학습하는 마리오 AITD3를 이용한 자율주행 학습 시 동일한 스크립트임에도 모델 성능이 크게 차이 나는 문제강화학습을 통해 스스로 학습하는 마리오 AI 봇 개발 및 소스 코드 공개