본문으로 건너뛰기

self-referential-bias

자기 참조 편향

AI 모델이 자신이 내뱉은 오류를 스스로 검토할 때, 이를 오류로 인지하지 못하고 자신의 논리를 정당화하거나 강화하려는 경향이다. 이를 해결하기 위해 서로 다른 모델이 교차 검증하는 방식이 권장된다.