본문으로 건너뛰기

deep-alignment

딥 정렬

고도로 능력 있는 AGI에서 목표 일관성을 확보하려는 연구 분야로, 모델 내부 구조와 학습 역학을 분석해 안전성 보장을 목표로 한다.