본문으로 건너뛰기
RLFT
강화학습 기반 추론 학습
추론 능력을 강화하기 위한 강화학습 기법이다. 모델의 추론 과정을 보상으로 학습시켜 논리적 사고와 문제 해결 능력을 개선한다.
비슷한 개념
Agentic Reinforcement Learning
RFT
Reinforcement Fine-Tuning
Reinforcement Learning with Verifiable Rewards
Reinforcement Pre-Training
scaled-rl
MBRL
RLVR
← 용어 사전 전체 보기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필