본문으로 건너뛰기

지연 결합 사가: 에이전트가 단순한 루프 속 LLM이 아닌 이유

LLM 에이전트의 신뢰성을 높이기 위해 단순 루프 구조 대신 실행 상태를 런타임이 관리하고 의도를 원장에 기록하는 'Late-Bound Saga' 패턴을 제안한다.

섹션별 상세

01
단순 루프 구조의 에이전트는 프로세스 장애 시 중복 실행(Double-charging) 문제를 피하기 어렵다. 데이터의 지속성(Durability)만으로는 부족하며, 프로그램의 명령 포인터가 살아남는 연속성(Continuity)이 보장되어야 한다. 이를 위해 애플리케이션 코드가 아닌 별도의 런타임이 실행 상태를 소유해야 한다.
python
@agent
def run_agent(task):
    while not done(task):
        intent = yield plan(task)
        result = yield execute(intent)
        task = yield append(task, result)

런타임이 실행 상태를 소유하도록 설계된 Late-Bound Saga 방식의 에이전트 구조 예시

02
워크플로의 단계가 길어질수록 각 단계의 미세한 실패 확률이 누적되어 전체 성공률이 급격히 떨어진다. 99% 신뢰도의 단계라도 200단계가 겹치면 성공률은 13%까지 하락하며, 루프 방식은 처음부터 다시 시작해야 하므로 비용과 시간이 낭비된다. 런타임 기반의 지속성 실행은 실패한 지점부터 재개하여 이 문제를 해결한다.
03
LLM은 계획만 세우는 순수 함수여야 하며 실제 실행 권한을 가져서는 안 된다. LLM이 의도를 제안하면 런타임이 이를 원장에 기록한 뒤 실행하고 결과를 다시 기록하는 'LLM Proposes, Runtime Disposes' 구조를 지향해야 한다. 이 엄격한 분리를 통해 실행의 가시성과 제어력을 확보할 수 있다.
04
Late-Bound Saga는 LLM이 런타임에 워크플로 그래프를 한 노드씩 동적으로 확장해 나가는 방식이다. 실행 전 의도 기록과 실행 후 결과 기록이라는 '브래킷(Bracket)' 구조를 통해 복구 시 외부 시스템 확인 없이도 작업 완료 여부를 판단한다. 이는 동적인 유연성과 엄격한 내구성을 동시에 제공한다.
05
에이전트 런타임은 의도 원장, 실질적 1회 실행, 프로세스 경계를 넘는 중단 및 재개, 외부 신호 전달 기능을 제공해야 한다. 특히 외부 신호(Signal)는 실행 중인 에이전트의 계획을 무효화하고 새로운 컨텍스트를 주입할 수 있게 하여 인간이나 감독 에이전트의 개입을 가능하게 한다.
python
@agent(model="claude-sonnet-4-6")
def hire_for_role(role: str, recruiter_id: str):
    """
    Find the three best candidates for the given role and schedule first-round interviews with each of them.
    """

Agentspan 라이브러리를 사용하여 선언적으로 정의된 에이전트 워크플로 예시

용어 해설

지연 결합 사가(Late-Bound Saga)
실행 시점에 LLM이 워크플로 그래프의 다음 단계를 동적으로 결정하고, 각 단계를 실행 전후로 영구 원장에 기록하는 패턴이다. 미리 정의된 그래프 없이 모델이 런타임에 경로를 생성하며, 장애 발생 시 정확한 지점에서 재개할 수 있는 내구성을 제공한다.
지속성 실행(Durable Execution)
프로세스 장애나 인프라 중단에도 불구하고 프로그램의 상태와 실행 위치를 보존하여 중단된 지점부터 정확히 재개할 수 있게 하는 기술이다. 단순 데이터 저장을 넘어 명령 포인터의 연속성을 보장함으로써 중복 실행 등의 부작용을 방지한다.
실질적 1회 실행(Effectively-once Execution)
시스템 장애나 재시도 상황에서도 특정 작업(예: 결제 API 호출)이 결과적으로 단 한 번만 실행되도록 보장하는 메커니즘이다. 의도치 않은 중복 처리를 막아 비즈니스 로직의 무결성을 유지하는 핵심 요소이다.
의도 원장(Intent Ledger)
LLM이 제안한 다음 행동(의도)을 실제 실행하기 전에 영구적으로 기록하는 저장소이다. 실행 전후의 상태를 모두 기록함으로써 시스템 복구 시 해당 작업의 완료 여부를 외부 상태 확인 없이도 즉시 판단할 수 있게 한다.

기술

  • Agentspan
  • Conductor
  • Claude 3.5 Sonnet
  • Python
  • Kubernetes
  • Postgres

활용 사례

  • 장기 실행 채용 프로세스 자동화
  • 결제 및 외부 API 연동이 포함된 비즈니스 워크플로
  • 인간의 승인이 필요한 다단계 에이전트 작업

언급된 리소스

AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 04. 14.수집 2026. 04. 15.출처 타입 RSS

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.