적대적 프로빙
시스템의 취약점을 찾기 위해 의도적으로 악의적 시나리오나 조작 입력을 생성해 모델이나 에이전트의 반응을 관찰하는 기법이다. 입력 대화 또는 행위를 통해 권한 이탈, 도구 오용, 범위 위반 같은 실패 모드를 유도하고 출력 로그와 행동 패턴을 수집해 취약점을 식별한다. 보안 테스트 엔진이 실제 대화 흐름에서 자동으로 프로빙을 실행하면 재현 가능한 공격 사례를 확보하고 보완 조치를 우선 적용할 근거를 제공한다.