본문으로 건너뛰기

Query-aware Compression

질의 인식 문맥 압축

질의 인식 문맥 압축은 검색된 문서 전체를 그대로 주 모델에 전달하지 않고, 작은 모델이 질문과 각 문서를 함께 읽어 답변에 필요한 원문 구간만 추출하는 방식입니다. 문맥을 요약하거나 바꾸지 않고 출처 식별자와 원문 표현을 유지해 입력 토큰과 비용을 줄입니다.