본문으로 건너뛰기
HF Daily Papers조회 1

생성과 동시에 실행: LLM 코드 생성의 실행 지연 시간 제거

기존 LLM 코딩 에이전트는 코드를 모두 생성한 뒤에야 실행을 시작하여 사용자 대기 시간이 길었다. 이 논문은 코드가 생성되는 도중에 실행을 병렬로 진행하는 패러다임을 제시하여 대기 시간을 획기적으로 줄이고, 오류 발생 시 즉시 중단하여 추론 비용을 절감한다.

용어 해설

추상 구문 트리(AST)
프로그래밍 언어의 구문 구조를 트리 형태로 표현한 추상적 자료구조이다. Eager는 생성되는 토큰 스트림을 실시간으로 AST로 파싱하여 실행 가능한 최소 단위인 문장(Statement) 경계를 식별한다.
종단 간 지연 시간(End-to-End Latency)
사용자가 입력을 제공한 시점부터 최종 결과(코드 실행 결과)를 받을 때까지 소요되는 전체 시간이다. 생성과 실행을 병렬화하여 이 시간을 단축하는 것이 본 연구의 핵심 목표이다.
동적 배칭(Dynamic Batching)
여러 개의 개별 작업을 하나의 묶음으로 처리하여 시스템 오버헤드를 줄이는 기법이다. Eager에서는 실행기가 사용 가능해질 때까지 대기열에 쌓인 여러 코드 청크를 하나로 병합하여 실행 효율을 높인다.
룩어헤드 전략(Lookahead Strategy)
현재 상태에서 다음 토큰을 미리 확인하여 의사결정을 내리는 방식이다. 파이썬의 들여쓰기 구조에서 현재 문장이 끝났는지 아니면 다음 줄로 이어지는지 판단하기 위해 한 토큰을 더 기다린 후 실행 여부를 결정한다.
AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 04. 01.수집 2026. 04. 04.출처 타입 PAPER

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.