블로킹 키
모든 후보 쌍(n^2)을 비교하지 않기 위해 레코드를 그룹화하는 방식으로, 표준화된(예: 음역된) 형태에서 일부 특징을 추출해 같은 블록 안에서만 유사도 비교를 수행함으로써 대규모 데이터에서 계산량을 실질적으로 줄인다.