본문으로 건너뛰기
rlaif
AI 피드백 기반 강화학습
중급
인간 대신 성능이 뛰어난 AI 모델이 다른 모델의 응답을 평가하고 피드백을 주어 학습시키는 방식으로, 비용 효율성과 확장성이 매우 높다.
비슷한 개념
rlhf
rlft
reward-modeling
group-based-rl
neural-feedback
mbrl
recursive-model-improvement
contrastive-feedback
← 용어 사전 전체 보기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필