본문으로 건너뛰기

premium-inference

프리미엄 추론

에이전트식 워크플로우에서 지연에 민감한 출력 토큰을 높은 속도로 안정적으로 제공하기 위한 별도 서비스 티어로, 응답 지연과 처리 비용의 균형을 맞춰 수익화가 가능한 토큰 공급을 목표로 한다.