본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
Anthropic의 사회적 영향 연구팀: AI의 실제 활용과 가치 정렬 탐구
Claude 헌법 및 OpenAI 모델 스펙 준수 여부에 대한 레드팀 평가 보고서
AI의 HHH 가치 신성화 위험과 대응 방안
LLM에게는 '할머니'가 필요하다: 지식 붕괴에 대한 아세모글루 논문의 비판적 검토
Clawdbot과 에이전트 정렬: 자율형 AI의 안전한 미래를 위한 설계
지능의 길들이기: 사이버네틱 공진화로서의 AI 정렬
Anthropic은 Claude가 살아있다고 생각하는가? '의식'에 대한 논란
페르소나 선택 모델: AI 어시스턴트가 인간처럼 행동하는 이유
Anthropic, Claude를 위한 새로운 헌법 공개: 가치와 행동 지침의 전면 개편
다리오 아모데이의 '기술의 사춘기': 인공지능의 미래에 대한 4가지 거대한 예측
백악관의 새로운 AI 규제가 앤스로픽과 클로드를 위협할 수 있다는 우려
Anthropic 정렬(Alignment) 연구팀의 비전과 주요 성과
← 피드로 돌아가기
Constitutional AI
Safety (AI 안전성)
약 21개 아티클
관련 태그:
Anthropic
Claude
Alignment
RLHF
OpenAI
ChatGPT
AI Alignment
Claude Code
Claude 3.5 Sonnet
Claude 3