선호도 페어
두 개 이상의 모델 출력을 상대적으로 비교해 올바른 출력이 더 높은 순위를 갖도록 하는 데이터 쌍으로, 순위 기반 손실이나 정렬 학습에 사용되어 잘못된 응답보다 바람직한 응답을 우선 학습하게 만든다.