본문으로 건너뛰기

Embedding DB

임베딩 데이터베이스

임베딩 데이터베이스는 텍스트를 벡터로 저장하고 유사도 검색을 통해 중복이나 근접 문서를 찾는 저장소이다. 본문에서는 기사 임베딩을 기반으로 중복을 판별하여 동일하거나 유사한 기사 항목을 제거하는 데 사용됐다. 유사도 기반 필터링을 통해 중복 노출을 줄이고 집계 목록의 고유성을 확보하는 역할을 했다.