Query-aware Compression
질의 인식 문맥 압축
질의 인식 문맥 압축은 검색된 문서 전체를 그대로 주 모델에 전달하지 않고, 작은 모델이 질문과 각 문서를 함께 읽어 답변에 필요한 원문 구간만 추출하는 방식입니다. 문맥을 요약하거나 바꾸지 않고 출처 식별자와 원문 표현을 유지해 입력 토큰과 비용을 줄입니다.
질의 인식 문맥 압축
질의 인식 문맥 압축은 검색된 문서 전체를 그대로 주 모델에 전달하지 않고, 작은 모델이 질문과 각 문서를 함께 읽어 답변에 필요한 원문 구간만 추출하는 방식입니다. 문맥을 요약하거나 바꾸지 않고 출처 식별자와 원문 표현을 유지해 입력 토큰과 비용을 줄입니다.