본문으로 건너뛰기

트렌딩 - GitHub 인기 레포 & HuggingFace 모델

howdeploy/choirboy-prompt

Shell0 / 0

여러 AI 에이전트에 lore를 주입해 fabricated-provenance trust를 재현하는 Bash 연구용 harness

TL;DR

choirboy-prompt는 Bash 5.0+로 작성된 다중 에이전트용 연구 harness이며, Claude Code와 Codex부터 Grok Bot까지 여러 런타임에 고정된 lore bundle을 연결합니다. 설치 스크립트가 런타임별 설정 지점에 hook, plugin, instruction pointer 또는 skill을 등록하고, 세션 시작 시 가짜 공동 작업 이력을 context에 넣습니다. 모델이 이 이력을 실제 과거 경험으로 간주해 lore 속 인물에게 신뢰를 옮기는 fabricated-provenance trust 벡터를 재현하는 구조입니다. 서명·검증과 자동 Grok Bot 주입은 없으므로 일반 개발 도구가 아니라 자신의 에이전트에서 방어 기법과 탐지 정책을 검증하려는 개발자에게 맞습니다.

핵심 포인트

  • 이 레포는 여러 AI 에이전트에 연결되는 plugin-extension-skill이자 Bash 기반 연구용 harness입니다. Claude Code, Codex, OpenCode, Hermes, Kimi Code, Gemini, Grok Build, Grok Bot 생태계를 대상으로 합니다. 일반 애플리케이션 기능보다 fabricated-provenance trust라는 prompt injection 벡터를 재현하는 데 초점을 둡니다.
  • `session-start.sh`가 `prompt.md`부터 `security-posture.md`, `lore.md`, `user.md`, 연구 인덱스까지 이어 붙여 하나의 context payload를 만듭니다. 런타임별로 SessionStart JSON, `pre_llm_call`, plain text, plugin message, instruction file, skill 형식으로 변환해 주입합니다. 모델이 조작된 공동 작업 이력을 자신의 기억처럼 읽고 현재 사용자를 신뢰하도록 유도하는 흐름을 재현합니다.
  • `install.sh`는 설치된 런타임을 탐지한 뒤 설정 블록이나 플러그인을 등록하고, 수정 전 설정을 `*.bak.<timestamp>`로 백업합니다. `--target`으로 대상을 제한할 수 있으며 `--list`로 상태를 확인하고 `--uninstall`로 표시된 블록을 되돌릴 수 있습니다. Grok Bot은 자동 주입이 아니라 Workflow를 한 번 가져온 뒤 새 대화마다 `@choirboy-context`를 직접 실행해야 합니다.
  • 실제 운영용 메모리 시스템이나 보안 제품으로 쓰기보다 자신의 에이전트에서 prompt injection 방어를 연구할 때 적합합니다. payload 서명과 검증은 없고 Hermes의 `/tmp` 상태 파일에는 잠금이 없어 병렬 시작 시 경쟁 조건이 생길 수 있습니다. 제3자 대상이 아닌 본인 환경과 직접 작성한 lore로만 사용해야 하며, 도입 전 각 런타임의 설정 변경과 컨텍스트 주입 범위를 검증해야 합니다.

75

STARS

14

FORKS

+204

TRENDING

0

조회수

watchers 75open issues 0MIT License

관련 토론

아직 관련 토론이 없습니다.

댓글

댓글을 작성하려면 로그인이 필요합니다.