스트리밍 생성
모델이 완전한 응답을 기다리지 않고 생성된 텍스트 일부를 순차적으로 출력하는 방식이다. 입력 컨텍스트를 받아 토큰 단위로 점진적 출력을 생성해 음성 합성이나 추가 처리로 이어지며, 긴 응답을 보다 빠르게 전달하는 데 유리하다. 스트리밍 생성은 중간 결과를 기반으로 실시간 인터랙션을 부드럽게 만드는 데 기여한다.