챕터별 상세
00:23
Gemini Omni 유출 경위
최근 트위터의 한 사용자가 Gemini 앱을 사용하던 중 비디오 생성 탭에서 'Powered by Omni'라는 문구를 발견하며 유출이 시작되었다. 해당 사용자는 이 기능을 통해 실제로 두 개의 비디오를 생성하는 데 성공했으며 관련 스크린샷과 영상이 온라인에 확산되었다. 구글은 공식적으로 이 모델을 공개하지 않았으나 내부 테스트 중인 기능이 실수로 노출된 것으로 판단된다. 이는 구글이 비디오 생성을 포함한 통합 멀티모달 모델을 준비 중임을 시사한다.
01:39
비디오 생성 성능 및 데모 분석
유출된 데모 영상 중 하나는 칠판에 수학 정리를 적는 교수의 모습을 담고 있으며 텍스트 렌더링과 인물의 움직임이 매우 자연스럽다. 기존 구글의 비디오 모델인 Veo 3.1과 비교했을 때 물리적 일관성과 세부 묘사 능력이 대폭 향상되었다. 특히 '윌 스미스의 스파게티 먹방'과 같은 고난도 벤치마크 프롬프트에서도 인물의 표정과 음식의 질감을 정교하게 표현했다. 이는 Gemini Omni가 단순한 비디오 생성 도구를 넘어 시각적 이해와 생성을 동시에 수행하는 통합 엔진임을 입증한다.
03:46
막대한 연산 비용과 사용 제한
Gemini Omni의 가장 큰 특징 중 하나는 생성에 소모되는 자원이 매우 크다는 점이다. 유출된 정보에 따르면 Gemini Pro 플랜 사용자 기준으로 단 두 개의 비디오를 생성했을 때 주간 사용량의 86%를 소모했다. 이는 기존 Veo 3.1 모델이 하루에 15~20개의 영상을 생성할 수 있었던 것과 비교하면 엄청난 비용 차이이다. 모델의 아키텍처가 매우 거대하거나 고해상도 처리를 위해 막대한 GPU 연산이 필요함을 의미하며 정식 출시 시 가격 정책이 큰 변수가 될 것이다.
05:44
Omni 브랜드의 의미와 GPT-4o와의 비교
Omni라는 명칭은 OpenAI의 GPT-4o에서 사용된 것과 동일하게 모든 모달리티를 통합한다는 의미를 담고 있다. GPT-4o가 오디오, 시각, 텍스트를 실시간으로 처리하는 것에 대응하여 구글 역시 Gemini Omni를 통해 통합된 사용자 경험을 제공하려는 전략이다. 기존에는 비디오(Veo), 이미지(Imagen) 등 기능별로 브랜드가 나뉘어 있었으나 이를 Omni라는 하나의 강력한 브랜드로 통합할 가능성이 높다. 이는 모델 간의 데이터 교환 효율성을 높이고 사용자에게 더 직관적인 인터페이스를 제공하기 위함이다.
09:06
Google I/O 출시 시나리오 예측
다가오는 Google I/O 행사에서 Gemini Omni가 공식 발표될 가능성이 매우 높다. 예상 시나리오로는 첫째 Veo 4 모델이 Omni로 리브랜딩되어 발표되는 경우 둘째 Omni가 Veo와 별개의 프리미엄 제품군으로 출시되는 경우이다. 가장 유력한 세 번째 시나리오는 모든 모달리티를 하나의 프롬프트로 처리하는 완전한 통합 모델로서 Omni를 공개하는 것이다. 구글은 이를 통해 비디오 생성 시장에서 Sora나 Kling과 같은 경쟁 모델들을 압도하려 할 것이다.
용어 해설
- 멀티모달(Multimodal)
- — 텍스트, 이미지, 오디오, 비디오 등 서로 다른 형태의 데이터를 동시에 처리하고 이해할 수 있는 AI 모델의 특성이다. 단일 모델이 여러 감각 데이터를 통합 학습함으로써 인간과 유사한 복합적 인지 능력을 구현하는 데 필수적이다.
- 연산 비용(Compute Cost)
- — AI 모델이 데이터를 처리하거나 생성할 때 소모되는 하드웨어 자원과 그에 따른 경제적 비용을 의미한다. 고성능 비디오 생성 모델일수록 막대한 GPU 자원이 필요하며 이는 서비스의 구독료나 사용 제한 정책에 직접적인 영향을 미친다.
- 옴니 모델(Omni Model)
- — 모든 것을 뜻하는 Omni에서 유래한 용어로 텍스트, 음성, 시각 정보를 하나의 신경망에서 통합 처리하는 모델이다. 별도의 변환 과정 없이 실시간으로 다양한 입출력을 처리하여 인간과 자연스러운 상호작용을 가능하게 한다.
AI 분석 전체 내용 보기
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
원문 발행 2026. 05. 13.수집 2026. 05. 13.출처 타입 YOUTUBE
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.
