본문으로 건너뛰기

learned-sparse-retrieval

학습형 희소 검색

신경망이 어휘별 가중치를 예측해 희소 벡터를 생성하는 방법론으로, SPLADE 계열이 대표적이다. 토큰 수준 프로젝션과 시퀀스 풀링으로 문서의 어휘 확장을 수행하며 역색인으로 서비스할 수 있다. 본문에서는 LSR을 decoder-only MLLM으로 확장하는 것이 핵심적 배경이다.