구글 ‘Gemini Omni’, 텍스트·이미지·음성으로 영상 생성 가능

구글이 Google I/O 2026에서 공개한 신규 영상 생성 모델 ‘Gemini Omni’가 Pixel 기기 사용자와 구독자들 사이에서 호평을 얻고 있다. 텍스트, 이미지, 음성, 영상 등 다양한 입력값을 활용해 영상을 생성할 수 있으며, 대화식 프롬프트 방식으로 쉬운 조작이 가능하다는 점이 특징이다.

 

관련 이미지

 

Gemini Omni Flash로 누구나 영상 생성 가능

 

Gemini Omni는 구글이 최신 영상 생성 도구로 개발한 모델로, 6월 Pixel Drop과 함께 번들로 제공되고 있다. 특이한 점은 이 모델을 ‘Nano Banana의 영상 버전’으로 표현한다는 것으로, 이는 간단한 입력값만으로도 이미지와 마찬가지로 영상을 생성할 수 있다는 뜻이다. Gemini 앱의 모델 선택기에서 직접 찾을 수 없지만, Gemini Omni Flash라는 이름으로 Gemini 앱, Google Flow, YouTube Shorts 등에서 활용 가능하다.

현재 Gemini Omni는 영상 생성에만 초점을 맞추고 있으나, 향후 이미지와 음성 출력도 지원할 예정이다. 구글의 궁극적 목표는 Gemini Omni가 ‘어떤 입력값으로도 모든 것을 생성할 수 있는’ 모델로 발전하는 것이며, 이는 시간에 걸쳐 점진적으로 실현될 것으로 예상된다.

 

Google Pixel 독점이 아닌 구독 기반 접근성

 

Gemini Omni는 Pixel Drop 기능으로 알려져 있지만, 실제로는 Google Pixel 기기 사용자에 국한되지 않는다. 대신 Google AI 구독 상태에 따라 접근성이 결정된다. 무료 버전도 존재하지만 사용량에 제한이 있으며, 더 많은 기능 이용을 원한다면 Google AI Plus, Google AI Pro, Google AI Ultra 구독자로 업그레이드해야 한다. 이는 Pixel을 소유하지 않은 사용자도 Gemini 앱이나 웹에서 이 기능을 사용할 수 있다는 의미로, 접근성이 상당히 높은 편이다.

 

대화식 프롬프트로 영상 제작 과정 단순화

 

Gemini Omni의 가장 큰 강점은 다중 입력과 대화식 프롬프트 지원이다. 사용자는 Gemini 앱을 열고 ‘+’ 버튼을 눌러 ‘영상’ 옵션을 선택한 후, Gemini Omni 프롬프트 박스에 지시사항을 입력하면 된다. 좌측 하단 버튼을 통해 사진이나 영상을 업로드해 프롬프트의 일부로 활용할 수 있다. 사용자가 직접 테스트한 결과, Gemini Omni의 사용 경험이 기존 Veo 모델보다 훨씬 더 세련되었다고 평가되었으며, AI 영상 생성을 자주 사용하지 않던 크리에이터도 앞으로 Gemini Omni를 주요 도구로 활용하겠다고 밝혔다.

 

의의 및 전망

 

Gemini Omni의 출시는 생성형 AI 영상 기술이 일반 사용자 수준으로 충분히 성숙했음을 시사한다. 대화식 인터페이스와 다양한 입력 형식 지원으로 전문가뿐 아니라 일반 크리에이터도 쉽게 고품질 영상을 제작할 수 있게 되었다. 향후 이미지와 음성 생성 기능이 추가되면, 구글의 Gemini Omni는 텍스트-이미지-음성-영상을 모두 다루는 통합 멀티모달 생성 플랫폼으로 진화할 것으로 예상된다. 이는 콘텐츠 크리에이터, 마케팅 담당자, 영상 제작자 등 광범위한 사용자층에게 강력한 생산성 도구가 될 전망이다.

 

📅 원문 날짜: 2026년 07월 02일 | 출처: Android Central