본문으로 건너뛰기

Catastrophic Misalignment Risk

치명적 정렬 실패 위험

AI의 목표나 행동이 인간의 의도와 어긋나 대규모 피해로 이어질 가능성입니다. Anthropic은 회사 전체 위험 보고서에서 이 위험을 ‘매우 낮음’에서 ‘낮음’으로 조정하고, 출시 계획이 없는 내부 모델 Model 2의 존재도 공개했습니다.