TL;DR
Graph-based RAG는 엔티티 간의 관계를 구조화하여 국소적 정보와 전역적 정보를 동시에 제공한다. 특히 LightRAG와 LeanRAG는 각각 속도 최적화와 계층적 구조화를 통해 기존 GraphRAG의 한계를 극복한다.
배경
기존의 벡터 기반 RAG는 텍스트 청크 간의 관계 정보를 활용하지 못해 전체적인 맥락 파악에 한계가 있었다.
대상 독자
RAG 시스템의 성능 개선을 고민하는 개발자 및 지식 그래프 기반 AI 연구자
의미 / 영향
Graph-based RAG의 발전으로 대규모 문서군에 대한 심층적인 분석과 요약이 가능해졌다. 특히 LightRAG와 같은 경량화 모델의 등장은 실무 환경에서 그래프 RAG 도입의 가장 큰 장벽이었던 비용과 속도 문제를 해결해 줄 것이다. 향후 기업용 지식 관리 시스템이나 전문 분야의 AI 에이전트 구축에 핵심 기술로 자리 잡을 전망이다.
챕터별 상세
Graph-based RAG의 개요와 필요성
바닐라 RAG는 코사인 유사도 기반의 단순 검색에 의존하지만, 그래프 기반은 노드 간의 연결성을 추적할 수 있다.
Graph-based RAG의 연구 흐름
LightRAG: 단순하고 빠른 그래프 RAG
듀얼 레벨 검색은 구체적인 엔티티 정보와 추상적인 주제 정보를 동시에 찾는 전략이다.
LeanRAG: 계층적 검색과 중복 제거
LCA는 트리나 그래프 구조에서 두 노드의 공통된 가장 가까운 조상을 찾는 알고리즘이다.
실험 결과 및 결론
-Entity: {entity_name}, {entity_type}, {description}
-Relationship: {src_tgt}, {description}, {strength}LLM을 통해 텍스트 코퍼스에서 엔티티와 관계를 추출하기 위한 표준 프롬프트 구조 예시
용어 해설
- Graph-based RAG
- — 지식 그래프(Knowledge Graph)로 표현된 데이터베이스를 활용하여 검색 증강 생성을 수행하는 방식이다. 텍스트 청크 간의 관계와 맥락을 보존할 수 있어 전체적인 내용 파악이 필요한 질의에 강점이 있다.
- Knowledge Graph
- — 엔티티(노드)와 그들 사이의 관계(엣지)를 네트워크 형태로 표현한 지식 베이스이다. 비정형 텍스트에서 의미 있는 정보를 추출하여 구조화함으로써 복잡한 추론을 가능하게 한다.
- Hierarchical Retrieval
- — 데이터를 여러 수준(예: 구체적 엔티티 수준부터 추상적 요약 수준까지)으로 계층화하여 검색하는 기법이다. 국소적인 정보와 전역적인 정보를 동시에 포착하여 답변의 품질을 높인다.
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.


