본문으로 건너뛰기
AI Trends
피드
트렌딩
커뮤니티
탐색
보관함
로그인
홈
트렌딩
커뮤니티
보관함
프로필
speculation
추론 가속
중급
직렬 처리로 인한 LLM의 추론 지연 문제를 해결하기 위한 기법. 작은 모델이 초안을 빠르게 생성하고 큰 모델이 이를 검증하는 방식으로 전체 처리 속도를 높인다.
비슷한 개념
inference-acceleration
speculative-decoding
parallel-inference
inference-scaling
reasoning-scaffolding
inference-time-reasoning
inference-optimization
inference-accelerator
← 용어 사전 전체 보기