PyTorch 데이터로더
PyTorch의 DataLoader는 데이터셋에서 배치를 생성하기 위해 샘플을 읽고 전처리하는 파이프라인 역할을 한다. 내부적으로 샘플 인덱스를 기반으로 데이터를 로드하고 선택된 수의 워커 프로세스로 병렬화하여 I/O와 변환 비용을 분산한다. DataLoader 설정(num_workers, pin_memory, persistent_workers)은 입력 파이프라인의 처리량과 GPU 활용률에 직접적인 영향을 준다.