1달 전Microsoft Research BlogMicrosoft Research Blog Agent Lightning으로 코드 수정 없이 에이전트에 RL 도입9달 전 발행요약 펼치기
1달 전Microsoft Research BlogMicrosoft Research Blog Argos로 시각 환각을 줄이고 샘플 효율을 높인 멀티모달 강화학습 검증 프레임워크7달 전 발행요약 펼치기
1달 전Microsoft Research BlogMicrosoft Research Blog 강화학습으로 임상 보상을 최적화한 UniRG-CXR 학습 데이터 56만건7달 전 발행1요약 펼치기
1달 전Microsoft Research BlogMicrosoft Research Blog 39개 아프리카어와 51개 모델로 시작하는 PazaBench와 Paza ASR 파이프라인7달 전 발행요약 펼치기