본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
Self-Distilled RLVR: 강화학습과 자기 증류를 결합한 안정적인 LLM 학습 프레임워크
읽기일 뿐, 생각하기가 아니다: 멀티모달 LLM에서 텍스트가 픽셀이 될 때 발생하는 모달리티 격차의 이해와 해소
← 피드로 돌아가기
Self-Distillation
Training (학습/파인튜닝)
약 5개 아티클
관련 태그:
Chain of Thought
GSM8K
InternVL 3.5
OPSD
Qwen3-VL
RLSD
RLVR