AI 코딩 에이전트 pi를 위한 자율 실험 및 최적화 루프 확장 도구
Agent·TypeScript6 / 0
터미널 기반 AI 에이전트 pi가 스스로 코드를 수정하고 벤치마크를 수행하며 성능을 최적화하는 자율 실험 루프 확장 도구이다.
주요 기능
- 실험 설정부터 벤치마크 실행 및 결과 기록까지의 자율 루프 수행
- Median Absolute Deviation 기반의 신뢰도 점수로 측정 노이즈 판별
- 실험 이력을 기반으로 유효한 변경사항을 독립적 브랜치로 자동 그룹화
- 터미널 내 실시간 대시보드 및 브라우저 기반 시각화 차트 제공
- 성능 최적화 후 코드 무결성을 검증하는 백프레셔 체크 스크립트 실행
어떻게 동작하는가
pi 에이전트가 autoresearch.md의 목표와 autoresearch.jsonl의 이력을 읽어 다음 실험을 결정하고, 쉘 스크립트로 메트릭을 측정하여 Git 커밋 및 리버트를 자율적으로 결정한다. 통계적 노이즈 대비 개선 폭을 계산하는 MAD 알고리즘으로 실험 결과의 유효성을 검증한다.
5.8k
Stars
321
Forks
+714
Trending
6
조회수
5.8k watchers9 open issues
관련 토론
아직 관련 토론이 없습니다.
댓글
댓글을 작성하려면 로그인이 필요합니다.