병렬 합성곱층(MoE 유사)
룩어헤드 설정별로 별도의 합성곱 계층을 병렬로 두고 학습 시 무작위로 하나를 선택하는 구조이다. 학습 시 패딩 변경으로 인한 비효율을 피하면서 사용자 지정 알고리즘 지연을 직접 제어할 수 있게 한다.