본문으로 건너뛰기

Adaptive Halting

적응형 종료

모델이 토큰별로 필요한 반복 횟수를 계산량에 따라 다르게 배정하는 방식입니다. 학습된 종료 확률이나 누적 확률이 임계값을 넘으면 해당 토큰의 반복을 멈추고, 쉬운 토큰에는 적은 연산을 어려운 토큰에는 더 많은 연산을 할당합니다.