본문으로 건너뛰기

qwen3.6-35b

qwen3.6-35b

작성자가 비교 대상으로 사용한 또 다른 언어 모델입니다. 같은 시스템에서 Prefill 약 3.5k와 초당 70~80토큰을 기록해 Qwen3.8-27b-q8보다 체감 속도가 나았지만, 비용 비교에서는 여전히 외부 서비스와 경쟁해야 했습니다.