Adaptive Halting
적응형 종료
모델이 토큰별로 필요한 반복 횟수를 계산량에 따라 다르게 배정하는 방식입니다. 학습된 종료 확률이나 누적 확률이 임계값을 넘으면 해당 토큰의 반복을 멈추고, 쉬운 토큰에는 적은 연산을 어려운 토큰에는 더 많은 연산을 할당합니다.
적응형 종료
모델이 토큰별로 필요한 반복 횟수를 계산량에 따라 다르게 배정하는 방식입니다. 학습된 종료 확률이나 누적 확률이 임계값을 넘으면 해당 토큰의 반복을 멈추고, 쉬운 토큰에는 적은 연산을 어려운 토큰에는 더 많은 연산을 할당합니다.