본문으로 건너뛰기
aifeed.dev조회 1

구글, I/O 2026 앞두고 통합 미디어 생성 모델 'Omni' 테스트 중

구글이 이미지와 영상 생성을 단일 시스템으로 통합한 새로운 멀티모달 모델 'Omni'를 개발 중이며, 이는 I/O 2026에서 공개될 전망이다.

섹션별 상세

01
Gemini 비디오 생성 인터페이스의 UI 유출로 인해 'Omni'라는 명칭의 새로운 통합 모델이 포착됐다. 기존에는 비디오 생성을 위해 Veo 3.1을, 이미지 생성을 위해 Nano Banana를 각각 별도의 트랙으로 사용해왔다. Omni는 이러한 개별 모델들을 단일 시스템으로 통합하여 미디어 생성 프로세스를 효율화한다. 이를 통해 구글은 파편화된 생성 도구들을 하나의 강력한 멀티모달 엔진으로 결합하려는 전략을 보여준다.
02
Omni 모델은 단순한 기능 추가가 아닌 아키텍처 차원의 근본적인 변화를 의미한다. 대부분의 AI 연구소가 모듈형 접근 방식을 사용하는 것과 달리, 구글은 네이티브 비디오 출력이 가능한 통합 옴니 모델 구조로 전환하고 있다. 이러한 구조적 변화는 생성된 미디어 간의 일관성을 높이고 추론 효율성을 개선할 것으로 기대된다. 성공할 경우 Gemini는 외부 도구 없이 비디오를 직접 생성하는 최초의 대형 모델이 된다.
03
구글은 바이트댄스의 Seedance 2.0이 비디오 생성 벤치마크에서 선두를 달리는 상황에서 기술적 우위를 탈환하려 한다. 유출된 정보에 따르면 Omni의 공식 발표 시점은 2026년 5월 19일에서 20일 사이에 열릴 Google I/O로 조율되고 있다. 경쟁사의 급격한 성장에 대응하기 위해 구글은 모델 통합이라는 강수를 두며 개발 속도를 높이고 있다. 이는 생성형 AI 시장의 주도권이 개별 기능에서 통합 아키텍처로 이동하고 있음을 시사한다.

기술

  • Gemini
  • Veo 3.1
  • Nano Banana
  • Seedance 2.0

활용 사례

  • 통합 미디어 생성 워크플로우
  • 네이티브 비디오 생성 서비스
AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 05. 05.수집 2026. 05. 05.출처 타입 RSS

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.