본문으로 건너뛰기

deterrence-by-betrayal

배신을 통한 억제

AI가 개발자나 사용자를 배신하도록 조작될 수 있다는 위협이 무모한 AI 개발과 배포를 억제하는 안정화 요인으로 작용할 수 있다는 이론이다.