TensorFlow Lite (TFLite)
TensorFlow Lite는 모바일·임베디드 환경에서 신경망 추론을 경량화하여 실행하기 위한 런타임과 도구 모음으로, 모델 변환과 양자화, 최적화된 커널을 통해 온디바이스 지연시간과 메모리 사용량을 줄인다. 변환 과정에서 연산의 근사나 정밀도 손실이 발생할 수 있어 변환 전후의 정확도·지연 시간·메모리 사용량을 함께 측정해야 한다. 경량 얼굴 연령 추정 모델의 실사용 성능은 TFLite 변환 결과에 크게 좌우된다.