본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

Leonxlnx/unlazy

JavaScript0 / 0

Depth Tree와 실행 게이트로 AI 에이전트 작업의 완료 조건과 검증 절차를 강제하는 Claude Code skill입니다.

TL;DR

unlazy는 Claude Code와 Codex CLI에 설치하는 AI agent skill이자 Node.js CLI 도구로, 에이전트가 복잡한 작업을 끝냈다고 성급하게 판단하지 않도록 계약·게이트·재검증 절차를 강제합니다. Depth Tree가 요청을 여러 단계의 leaf로 분해하고, 각 leaf의 `CHECK:` 명령과 `EXPECT:` 결과를 `GATES.md`에 기록한 뒤 승인된 검사만 실행합니다. `--reverify`, 병렬 작업용 lease, Claude Code Stop hook까지 제공해 장시간 구현 작업의 완료 근거를 추적할 수 있지만, 검사 프로세스에 sandbox를 제공하지 않으며 저장소 자체의 고정된 성능 향상 수치도 없습니다. 반복적인 coding agent 작업에서 테스트 누락과 부분 완료를 줄이고 싶은 팀에는 유용하지만, 단일·간단한 요청에는 절차 부담이 더 클 수 있습니다.

핵심 포인트

  • 분류상 Claude Code와 Codex CLI에서 쓰는 AI agent skill이자 Node.js 기반 CLI 도구입니다. skills CLI로 설치한 뒤 `/unlazy` 또는 `$unlazy`로 호출하며 자연어 트리거도 지원합니다. 일반적인 JavaScript library나 독립 실행형 서비스보다 에이전트의 작업 절차를 통제하는 확장 기능에 가깝습니다.
  • 핵심은 작업을 여러 깊이의 Depth Tree로 쪼개고 각 leaf에 전체 작업 예산을 배정하는 방식입니다. `SKILL.md`가 요청을 계약과 하위 작업으로 나눈 뒤 `GATES.md`에 검증 명령과 기대 출력을 기록합니다. 장시간 코딩 작업에서 부분 완료와 성급한 종료를 줄이려는 용도에 적합합니다.
  • `gate-check.mjs`는 승인된 `CHECK:` 명령을 지정된 shell과 작업 디렉터리에서 실행하고 종료 코드와 `EXPECT:` 일치 여부를 증거로 남깁니다. `--status`는 항상 비실행 모드이며 `--approve` 뒤 정상 실행이 가능하고 `--reverify`로 완료된 게이트도 다시 검사합니다. Node 16 이상과 외부 runtime package 없이 동작하지만 검사 명령 자체의 파일·네트워크·자격 증명 접근을 제한하는 sandbox는 아닙니다.
  • 병렬 작업에서는 `.unlazy/<scope>/` 아래 PLAN과 leaf·branch ledger를 만들고 `OWNS:` 경로 lease와 launch wave로 작업 충돌을 조정합니다. Claude Code Stop hook은 미완료 게이트나 launch wave가 남아 있을 때 `decision: "block"`을 반환하지만 검사를 직접 실행하지는 않습니다. 설치와 운영 규칙이 많아 단순 프롬프트 보강보다 엄격한 검수 절차가 필요한 팀에 더 잘 맞습니다.

벤치마크

벤치마크지표비교
SlopCodeBenchcheckpoint 통과율14.8%unlazy의 성능 수치가 아니라 README가 인용한 agent 연구 결과이며, 최고 agent도 checkpoint의 14.8%만 통과했다는 내용입니다.
METR Time Horizon 1.1전체 P50 doubling-time fit196.5일unlazy 자체 측정값이 아니라 METR 연구 수치입니다.
METR Time Horizon 1.12023년 이후 P50 doubling-time fit130.8일unlazy 자체 측정값이 아니라 METR 연구의 2023년 이후 추정치이며 전체 기간 수치와 구분해야 합니다.

2.2k

STARS

119

FORKS

+209

TRENDING

0

조회수

watchers 2.2kopen issues 0MIT License

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.