요약은 생성됐지만 현재 화면 버전과 데이터 형식이 맞지 않아 렌더링할 수 없습니다.
출처 · 인용 안내
원문 발행 2026. 02. 27.수집 2026. 03. 01.출처 타입 REDDIT
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.
요약은 생성됐지만 현재 화면 버전과 데이터 형식이 맞지 않아 렌더링할 수 없습니다.
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.
아직 관련 토론이 없습니다.
댓글을 작성하려면 로그인이 필요합니다.
스테레오 입력을 잠재공간과 원파형 두 경로로 변환하는 flow-matching 기반 모델을 공개했으며 amplitude lifting으로 웨이브폼 학습 불안정성을 해결하고 코드·모델·앱을 배포했다.
WanSong v1.0은 연속 오디오 토큰을 단일 확산 백본으로 직접 생성해 최대 5분 길이의 다국어 노래를 보컬과 BGM 분리 스템으로 한 번에 출력하고 VAE 1024 압축률과 RLHF로 품질을 개선했다.