TL;DR
SALT는 긴 문서를 정보량이 큰 문장들만 남겨 고정 크기 평문 프롬프트로 축소하는 기법으로, 모델에 전달되는 토큰 수를 줄여 계산·메모리·대기시간을 낮춘다. 이 방법은 특정 모델에 종속되지 않으며 압축된 프롬프트를 그대로 전달해 다양한 모델 환경에서 동작한다. 대화용 구현인 saltChat은 문서 인덱스를 렉시컬 트라이로 DRAM에 유지하여 문서를 한 번만 인덱싱하고 이후 턴에서 재사용함으로써 반복적 읽기 비용을 제거한다. 따라서 긴 문서 기반 애플리케이션에서 입출력 비용과 지연을 동시에 줄이는 실용적 방안으로 사용될 수 있다.
섹션별 상세
용어 해설
- Lexical Trie
- — 렉시컬 트라이는 문자열 또는 단어들의 접두사 구조를 트리 형태로 저장하는 자료구조이다. 각 노드는 공통 접두사를 공유하여 검색과 인덱싱 비용을 줄이며 메모리 내에서 빠른 조회를 가능하게 한다. SALT 맥락에서는 문서의 주제·테마를 트라이에 저장해 반복 읽기 없이 재사용하도록 유지하는 핵심 저장소 역할을 한다.
- Salience Scoring
- — 중요도 스코어링은 문장이나 토큰별로 정보량 또는 관련도를 수치화하는 절차이다. 입력 문서에서 정보량이 높은 문장을 선별하기 위해 각 문장에 점수를 부여하고 상위 문장들을 압축 출력으로 선택한다. SALT는 이 방식을 통해 긴 문서에서 핵심 정보만을 남기고 고정 크기 프롬프트로 변환한다.
- Prompt Compression
- — 프롬프트 압축은 긴 문서를 언어모델에 입력하기 적합한 길이로 줄이는 과정이다. 문장 선택과 재배열을 통해 원문 의미를 유지하면서 토큰 수를 감소시키고, 결과 프롬프트를 평문 텍스트로 생성한다. SALT는 프롬프트 압축을 적용해 계산량·메모리 사용·응답 대기시간을 줄이는 것을 목표로 한다.
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.

