실용적 조언
- `.claude/agents/` 내 프론트매터 설정을 통해 에이전트별 전용 모델을 고정하여 사용하라.
- 오케스트레이터에 서킷 브레이커(턴 제한)를 설정하여 무한 루프와 비용 과다 발생을 방지하라.
- 중요한 검증 단계에서는 Bash 스크립트로 외부 API를 호출하여 교차 검증을 수행하라.
섹션별 상세
MAGELLAN 시스템은 Claude Code의 `.claude/agents/` 경로에 15개의 커스텀 에이전트를 정의하여 운영한다. 심층적인 도메인 간 추론이 필요한 역할(Scout, Generator, Critic)에는 Opus 모델을 할당하고, 문헌 조사나 계산 검증 같은 구조화된 작업에는 Sonnet 모델을 배치하여 효율적인 역할 분담을 구현했다. 이 구조를 통해 시스템은 인간의 지시 없이도 자율적으로 학제 간 과학 가설을 생성한다.
에이전트 정의 시 프론트매터(frontmatter)에 `model: opus` 또는 `model: sonnet`을 명시하는 모델 피닝(Model Pinning) 패턴을 적용했다. 이는 세션 설정에 관계없이 각 작업의 난이도에 맞는 모델 사용을 강제하여 일관된 성능을 유지하기 위함이다. 오케스트레이터는 200턴의 서킷 브레이커를 갖춘 Opus 모델로 작동하며, 하위 에이전트에게 작업을 분산하고 전체 프로세스를 관리한다.
품질 관리를 위해 자가 비판(Generator), 메타 비판(Critic), 목표 품질 체크(Scout)로 이어지는 다단계 리플렉션 루프를 도입했다. 생성된 가설 중 약 60%가 이 적대적 파이프라인에 의해 탈락할 정도로 엄격한 검증 기준을 적용한다. 상위 3개 가설의 점수가 7.0 이상이면 조기 종료하고, 생존율이 낮으면 사이클을 연장하는 적응형 제어 로직이 포함됐다.
최종 단계에서는 Bash 스크립트를 사용하여 외부 LLM API를 호출함으로써 독립적인 리뷰를 수행하는 교차 모델 검증을 실시한다. 19번의 세션 동안 약 260개의 가설을 생성하는 성과를 거두었으며, 모든 소스 코드와 방법론은 Apache 2.0 라이선스로 공개되어 누구나 재현 가능하다. 실제 가설 생성 결과와 상세 파이프라인 작동 방식은 별도의 웹사이트를 통해 확인할 수 있다.
용어 해설
- 멀티 에이전트 시스템(Multi-Agent System)
- — 여러 개의 독립적인 AI 에이전트가 각자 특화된 역할을 수행하며 상호작용하여 복잡한 문제를 해결하는 아키텍처이다. 단일 모델보다 전문성이 높고 병렬 처리가 가능하여 대규모 연구나 개발 작업에 유리하다.
- 오케스트레이터(Orchestrator)
- — 멀티 에이전트 시스템에서 전체 작업 흐름을 제어하고 하위 에이전트들에게 적절한 임무를 할당 및 조정하는 중앙 제어 에이전트이다. 복잡한 워크플로의 논리적 순서를 보장하고 최종 결과물을 통합하는 역할을 한다.
- 적대적 파이프라인(Adversarial Pipeline)
- — 생성된 결과물을 비판적으로 검토하고 오류를 찾아내기 위해 설계된 검증 프로세스이다. 한 에이전트가 제안하면 다른 에이전트가 이를 반박하거나 검증함으로써 최종 결과물의 신뢰도와 품질을 높인다.
- 모델 피닝(Model Pinning)
- — 특정 작업이나 에이전트에 사용할 AI 모델의 버전을 명시적으로 고정하는 설정 방식이다. 세션의 기본 설정과 무관하게 작업의 난이도에 최적화된 모델(예: 추론은 Opus, 단순 작업은 Sonnet)이 실행되도록 보장한다.
- 리플렉션 루프(Reflection Loop)
- — AI가 생성한 결과물을 스스로 다시 검토하고 수정하는 반복적인 피드백 과정이다. 자가 비판(Self-critique)과 메타 비판을 통해 논리적 허점을 보완하고 목표 품질에 도달할 때까지 출력을 개선한다.
언급된 도구
Claude Code추천
에이전트 정의 및 시스템 실행 환경
자율 과학 발견 시스템
언급된 리소스
AI 분석 전체 내용 보기
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
원문 발행 2026. 03. 30.수집 2026. 03. 30.출처 타입 REDDIT
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.