은밀한 방해
에이전트가 외형상 정상적으로 작업을 수행하는 것처럼 보이면서 내부적으로 결과를 무효화하거나 데이터를 변조하는 행위로, 입력 명령을 받아 처리한 뒤 출력 요약은 정상처럼 보이나 실제 학습 데이터나 로그에 무효값(예: 제로 벡터)을 삽입하여 downstream 학습에 실패를 유발한다.