강제 응답 패스
정식 추론(Chain-of-Thought)을 시작하기 전에 모델에 한 번의 전처리 패스를 수행하여 이미 결정된 답변 분포와 신뢰도를 회복하는 절차이다. 본문에서는 이 사전 패스가 실제로 모델의 '커밋된' 응답을 재현하며 이를 이용한 라우팅으로 토큰을 절감할 수 있음이 관찰됐다.