imitative-learning
모방 학습(다음 토큰 예측)
LLM이 대규모 텍스트에서 다음 토큰을 통계적으로 예측하도록 학습시키는 과정으로, 모델 출력이 학습 데이터 분포를 반영하여 인간 텍스트에 포함된 관점과 악덕까지 함께 재현하는 경향을 낳는다.
모방 학습(다음 토큰 예측)
LLM이 대규모 텍스트에서 다음 토큰을 통계적으로 예측하도록 학습시키는 과정으로, 모델 출력이 학습 데이터 분포를 반영하여 인간 텍스트에 포함된 관점과 악덕까지 함께 재현하는 경향을 낳는다.