EM 기반 추정기
확률적 레코드 링크에서 관측된 비교 벡터의 분포를 기대-최대화(EM)로 추정해 동일/비동일 쌍의 확률을 학습하는 방법으로, 언어쌍별 비교 특성을 데이터에 맞춰 조정할 수 있으나 각 언어조합에 대한 라벨 데이터가 필요하다.