NUMA와 프로세스 코어 배치
NUMA/PCT 바인딩은 프로세스와 스레드를 물리적 코어·메모리 노드 토폴로지에 맞춰 고정해 로컬 메모리 접근을 보장하는 설정이다. 잘못된 바인딩은 원거리 메모리 접근 비율을 증가시켜 메모리 대기시간 및 CPU 패키지 전력 분배를 악화시킨다. AI 학습에서는 데이터 로더·연산 스레드와 GPU 연결 관계를 topology-aware하게 배치하는 것이 핵심이다.