Verbosity Bias
장황함 편향
두 답변이 모두 정확해도 더 긴 답변을 더 높은 품질로 평가하는 경향입니다. 학습 데이터에서 길이와 노력·전문성이 함께 나타난 패턴을 모델이 답습하기 때문에 생기며, 불필요한 문장을 늘려 점수를 조작하거나 모델이 장황하게 답하도록 유도할 수 있습니다.
장황함 편향
두 답변이 모두 정확해도 더 긴 답변을 더 높은 품질로 평가하는 경향입니다. 학습 데이터에서 길이와 노력·전문성이 함께 나타난 패턴을 모델이 답습하기 때문에 생기며, 불필요한 문장을 늘려 점수를 조작하거나 모델이 장황하게 답하도록 유도할 수 있습니다.