본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
관련 기사 바로가기
TSMOO: 제약형 Thompson 샘플링 기반 다목표 실험
로컬 LLM 에이전트의 반복적 실수를 방지하기 위한 톰슨 샘플링 기반 규칙 집행 시스템
Astrai Router: Thompson Sampling과 Berkeley ARBITRAGE를 활용한 오픈소스 지능형 LLM 라우터
← 피드로 돌아가기
Thompson Sampling
Optimization (최적화 기법)
약 5개 아티클
관련 태그:
ARBITRAGE
Astrai Router
EXP3
GPT-4o
LiteLLM
Multi-armed bandits
QR-DQN
Rainbow
TSMOO
UCB1