손으로 그린 그림이 바로 웹사이트로? Qwen3.5-Omni-Plus의 멀티모달 코딩 데모
Qwen3.5-Omni-Plus 모델이 사용자의 수기 스케치와 음성 명령을 실시간으로 해석하여 기능이 포함된 웹사이트를 생성하는 과정을 보여줍니다.
Alibaba의 Qwen 대형 언어 모델 공식 채널
Qwen3.5-Omni-Plus 모델이 사용자의 수기 스케치와 음성 명령을 실시간으로 해석하여 기능이 포함된 웹사이트를 생성하는 과정을 보여줍니다.
Qwen3-Omni-Flash는 비디오, 오디오, 텍스트를 동시에 이해하며 다양한 페르소나와 언어로 자연스러운 멀티턴 대화를 수행하는 옴니 모델이다.
Qwen3-Omni-Flash는 119개 언어 텍스트와 19개 언어 음성을 지원하며 실시간 비디오 및 오디오 이해를 통해 자연스러운 다중 턴 대화를 구현한 멀티모달 모델이다.
Qwen-Image-Layered는 이미지를 단일 레이어가 아닌 독립적인 RGBA 레이어들로 생성하여 무손실 편집과 무한 분해를 지원하는 혁신적인 모델이다.
Qwen-Image-Layered는 단일 이미지가 아닌 독립적인 RGBA 레이어들을 생성하여 무한 분해와 손실 없는 편집을 지원하는 네이티브 레이어 생성 모델이다.
알리바바의 Qwen3-TTS는 텍스트 지시어로 목소리를 생성하는 VoiceDesign과 3초 오디오로 목소리를 복제하는 VoiceClone 기능을 통해 고성능 다국어 음성 합성을 구현했다.
80만 개의 검증 가능한 작업과 MoE 구조를 통해 3B 활성 파라미터로 강력한 에이전트 성능을 구현한 Qwen3-Coder-Next의 핵심 기술을 소개한다.
Qwen-Image-2.0은 정교한 텍스트 렌더링, 2K 고해상도, 1,000 토큰 이상의 긴 프롬프트 지원을 통해 전문가 수준의 디자인과 이미지를 생성하는 모델이다.