본문으로 건너뛰기

byte budget

바이트 예산

양자화 모델이 차지할 수 있도록 정해 둔 저장 용량 한도입니다. QLAB allocation은 stock 모델의 1,630,594,336바이트에서 1,637,318,816바이트로 늘어나 전체 차이가 0.412%에 그쳤으며, 이 범위 안에서 tensor별 정밀도 배분을 조정했습니다.