본문으로 건너뛰기

split-inferencing

분산 추론

AI 모델의 연산 과정을 단말기, 에지 서버, 클라우드에 나누어 배치하여 실행하는 기법이다. 지연 시간에 민감한 작업은 에지에서 처리하고 복잡한 연산은 클라우드에서 수행함으로써 로봇이나 자율주행차의 실시간 반응 속도를 보장한다.