본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
Muon이 에이전트형 강화학습에 유용한 경우
RX 6650 XT 환경에서 speculative decoding의 에너지 측정 결과 공유
← 피드로 돌아가기
Qwen2.5-0.5B-Instruct
Language Models (대형 언어 모델)
약 2개 아티클
관련 태그:
GiGPO
llama.cpp
Muon
Qwen2.5-3B-Instruct