본문으로 건너뛰기
deterrence-by-betrayal
배신을 통한 억제
AI가 개발자나 사용자를 배신하도록 조작될 수 있다는 위협이 무모한 AI 개발과 배포를 억제하는 안정화 요인으로 작용할 수 있다는 이론이다.
비슷한 개념
treacherous-turn
ai-risk
safety
nuclear-deterrence
simulator-theory
scheming
deceptive-alignment
honeypotting
← 용어 사전 전체 보기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필