본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
Reasoning Enhancement
Reasoning Enhancement
추론 유틸리티를 강화하기 위해 VLM-유도 보상을 사용하는 RL 기반 학습으로, 편집의 효과가 최종 정답에 미치는 기여를 최대화한다.
비슷한 개념
VLM-derived rewards
reward-driven-execution
expert-calibrated-cot
rlft
Reasoning Imitation
agentic-reinforcement-learning
reinforcement-pre-training
Proxy Prompt Reinforcement Learning
← 용어 사전 전체 보기