본문으로 건너뛰기

imitative-learning

모방 학습(다음 토큰 예측)

LLM이 대규모 텍스트에서 다음 토큰을 통계적으로 예측하도록 학습시키는 과정으로, 모델 출력이 학습 데이터 분포를 반영하여 인간 텍스트에 포함된 관점과 악덕까지 함께 재현하는 경향을 낳는다.