Leonxlnx/unlazy
JavaScript0 / 0
Depth Tree와 실행 게이트로 AI 에이전트 작업의 완료 조건과 검증 절차를 강제하는 Claude Code skill입니다.
TL;DR
unlazy는 Claude Code와 Codex CLI에 설치하는 AI agent skill이자 Node.js CLI 도구로, 에이전트가 복잡한 작업을 끝냈다고 성급하게 판단하지 않도록 계약·게이트·재검증 절차를 강제합니다. Depth Tree가 요청을 여러 단계의 leaf로 분해하고, 각 leaf의 `CHECK:` 명령과 `EXPECT:` 결과를 `GATES.md`에 기록한 뒤 승인된 검사만 실행합니다. `--reverify`, 병렬 작업용 lease, Claude Code Stop hook까지 제공해 장시간 구현 작업의 완료 근거를 추적할 수 있지만, 검사 프로세스에 sandbox를 제공하지 않으며 저장소 자체의 고정된 성능 향상 수치도 없습니다. 반복적인 coding agent 작업에서 테스트 누락과 부분 완료를 줄이고 싶은 팀에는 유용하지만, 단일·간단한 요청에는 절차 부담이 더 클 수 있습니다.
핵심 포인트
- 분류상 Claude Code와 Codex CLI에서 쓰는 AI agent skill이자 Node.js 기반 CLI 도구입니다. skills CLI로 설치한 뒤 `/unlazy` 또는 `$unlazy`로 호출하며 자연어 트리거도 지원합니다. 일반적인 JavaScript library나 독립 실행형 서비스보다 에이전트의 작업 절차를 통제하는 확장 기능에 가깝습니다.
- 핵심은 작업을 여러 깊이의 Depth Tree로 쪼개고 각 leaf에 전체 작업 예산을 배정하는 방식입니다. `SKILL.md`가 요청을 계약과 하위 작업으로 나눈 뒤 `GATES.md`에 검증 명령과 기대 출력을 기록합니다. 장시간 코딩 작업에서 부분 완료와 성급한 종료를 줄이려는 용도에 적합합니다.
- `gate-check.mjs`는 승인된 `CHECK:` 명령을 지정된 shell과 작업 디렉터리에서 실행하고 종료 코드와 `EXPECT:` 일치 여부를 증거로 남깁니다. `--status`는 항상 비실행 모드이며 `--approve` 뒤 정상 실행이 가능하고 `--reverify`로 완료된 게이트도 다시 검사합니다. Node 16 이상과 외부 runtime package 없이 동작하지만 검사 명령 자체의 파일·네트워크·자격 증명 접근을 제한하는 sandbox는 아닙니다.
- 병렬 작업에서는 `.unlazy/<scope>/` 아래 PLAN과 leaf·branch ledger를 만들고 `OWNS:` 경로 lease와 launch wave로 작업 충돌을 조정합니다. Claude Code Stop hook은 미완료 게이트나 launch wave가 남아 있을 때 `decision: "block"`을 반환하지만 검사를 직접 실행하지는 않습니다. 설치와 운영 규칙이 많아 단순 프롬프트 보강보다 엄격한 검수 절차가 필요한 팀에 더 잘 맞습니다.
벤치마크
| 벤치마크 | 지표 | 값 | 비교 |
|---|---|---|---|
| SlopCodeBench | checkpoint 통과율 | 14.8% | unlazy의 성능 수치가 아니라 README가 인용한 agent 연구 결과이며, 최고 agent도 checkpoint의 14.8%만 통과했다는 내용입니다. |
| METR Time Horizon 1.1 | 전체 P50 doubling-time fit | 196.5일 | unlazy 자체 측정값이 아니라 METR 연구 수치입니다. |
| METR Time Horizon 1.1 | 2023년 이후 P50 doubling-time fit | 130.8일 | unlazy 자체 측정값이 아니라 METR 연구의 2023년 이후 추정치이며 전체 기간 수치와 구분해야 합니다. |
2.2k
STARS
119
FORKS
+209
TRENDING
0
조회수
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.