본문으로 건너뛰기

OmniRoam: 장기 파노라마 비디오 생성을 통한 가상 세계 탐험

기존 비디오 생성 모델은 시야각이 좁아 넓은 공간을 이동할 때 화면이 뭉개지거나 일관성이 깨지는 문제가 있었다. OmniRoam은 파노라마 방식을 도입해 360도 전체 시야를 확보함으로써, 아주 긴 경로를 이동해도 배경이 변하지 않고 유지되는 고화질 가상 탐험을 가능하게 한다.

용어 해설

정거도법 투영(Equirectangular Projection)
구형의 360도 전방위 장면을 2차원 평면 지도로 펼치는 방식이다. 위도와 경도를 각각 수직과 수평 좌표로 매핑하여 파노라마 이미지를 생성하며, 비디오 생성 모델이 전 방향의 공간 정보를 한 번에 학습하고 처리할 수 있게 돕는 핵심 표현법이다.
디퓨전 트랜스포머(Diffusion Transformer)
확산 모델(Diffusion)의 구조에 트랜스포머(Transformer) 아키텍처를 결합한 형태이다. 이미지나 비디오의 패치 단위 데이터를 입력받아 노이즈를 제거하며, 기존 CNN 기반 모델보다 확장성이 뛰어나 고해상도 및 장기 비디오 생성에 유리하다.
렉티파이드 플로우(Rectified Flow)
노이즈에서 데이터로 변하는 과정을 직선 경로로 학습시키는 생성 모델 프레임워크이다. 데이터 간의 이동 경로를 최적화하여 더 적은 단계로도 고품질의 샘플링을 가능하게 하며, 비디오 생성 시 프레임 간의 부드러운 전환을 보장한다.
AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 04. 01.수집 2026. 04. 02.출처 타입 PAPER

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.