본문으로 건너뛰기

full-precision-inference

Full-Precision Inference

모델 제작자가 의도한 수치 정밀도를 그대로 유지하면서 추론하는 방식입니다. Quantization처럼 낮은 정밀도로 변환해 속도를 얻는 대신 정확도를 일부 희생하지 않고, 하드웨어 구조를 통해 속도와 전력 효율을 개선하는 접근입니다.