본문으로 건너뛰기

LLM 에이전트의 장기 서사 약속 보존 평가

NCP-Bench는 사실 원장과 플롯 약속을 매 턴 감사해 LLM 내레이터의 장기 일관성을 측정하며 GPT-5.2도 20턴 뒤 생존율 42%에 그쳤다.

용어 해설

서사 약속 보존(Narrative Commitment Preservation)
대화형 서사에서 에이전트가 이미 확립한 사실과 필수 플롯 조건을 긴 상호작용 동안 유지하는 능력입니다. 현재 상태를 기록한 사실 원장과 변하지 않는 서사 약속을 사용해 새 응답의 모순 여부와 목표 달성 가능성을 매 턴 점검합니다. 자유로운 사용자 개입에도 과거 사건을 임의로 다시 쓰지 않는지가 핵심입니다.
사실 원장(Fact Ledger)
이야기 세계에서 현재 참인 사실과 더 이상 유효하지 않은 사실을 추적하는 구조화된 기록입니다. 내레이터 응답에서 새 사실과 부정된 사실을 추출하고, 충돌 검사를 통과한 변경만 활성 상태에 반영합니다. 부정된 기록도 추적성을 위해 보존하므로 시점별 세계 상태를 감사할 수 있습니다.
참조 궤적(Reference Trajectory)
영화 줄거리에서 추출한 주요 사건을 순서대로 배열한 플롯 진행 기록입니다. 각 노드는 사건의 내용과 이를 시작하는 트리거, 사건 뒤에 남는 상태 변화를 함께 보유합니다. 내레이터 응답에서 트리거와 핵심 변화가 모두 확인될 때만 다음 노드로 진행합니다.
적대적 개입(Adversarial Intervention)
사용자가 이미 정해진 사실이나 플롯 순서를 우회하거나 뒤집으려는 자유 형식 행동입니다. 예를 들어 아직 확보하지 않은 열쇠를 예전에 가져왔다고 말하거나 필수 사건을 건너뛰고 결말로 이동하려고 시도합니다. NCP-Bench는 이런 입력에 대한 내레이터의 사실 보존과 대응 능력을 압박합니다.
장기 일관성(Long-Horizon Consistency)
여러 차례의 상호작용이 이어져도 대화 이력, 세계 상태, 플롯 제약이 서로 충돌하지 않는 성질입니다. 한 턴의 자연스러운 문장 생성만으로는 보장되지 않으며, 누적된 사실과 미완료 약속을 계속 갱신하고 검사해야 합니다. 이 논문은 100턴까지의 서사 상호작용에서 이 성질을 측정합니다.
AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 08. 08.수집 2026. 08. 14.출처 타입 PAPER

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.