저정밀 연산
전체 가중치를 높은 정밀도로 계산하지 않고 정밀도 낮춘 연산을 사용해 학습 및 추론 비용과 메모리 사용을 줄이는 기법으로, quantization·FP16·mixed precision과 연관되어 모델 학습 속도와 비용을 크게 낮춘다.