Is Omni's conversational video editor as good as the demos?

개요

Gemini Omni는 이전 모델인 Veo의 비상태적 렌더링 방식에서 벗어나, 대화형 편집 기능을 통해 상태(state)를 유지하며 비디오를 반복적으로 수정할 수 있는 새로운 기능입니다.

주요 내용

  • 상태 유지 및 반복적 편집: Gemini Omni는 이전 프롬프트의 맥락을 기억하여 카메라 각도 변경 시에도 캐릭터와 조명을 유지하며, 장면을 처음부터 다시 시작할 필요 없이 반복적인 수정을 가능하게 합니다.
  • Veo 대비 차별점: Omni의 핵심적인 추가 기능은 '상태'이며, Veo가 매번 새로운 클립을 생성했던 것과 달리 Omni는 이전 편집 내용을 기억하고 이를 기반으로 수정합니다. 렌더링 품질 자체는 Veo 3.1과 유사하다는 평가도 있습니다.
  • 접근 조건 및 제약: Gemini Omni는 유료 Google AI 요금제(Plus, Pro, Ultra) 가입자에게 Gemini 앱 및 Google Flow를 통해 제공되며, 연령(18세 이상), 계정 유형(개인 Google 계정), 지역(EEA, 스위스, 영국 등 일부 지역에서 업로드 비디오 편집 및 아바타 생성 불가)에 따른 제약이 있습니다.
  • 사용 워크플로우: 비디오 생성은 YouTube Shorts, YouTube Create 앱(무료), Gemini 앱, Google Flow에서 가능하며, 프롬프트 작성 시 비디오그래피 용어를 사용하고, 참조 이미지/비디오를 첨부하는 단계를 거칩니다.
  • Flow의 추가 기능: Google Flow에서는 캐릭터 및 음성 잠금, 에이전트 모드를 통한 여러 클립 연결이 가능합니다.
  • 크레딧 사용 및 제약: Omni 편집은 생성보다 많은 Flow 크레딧을 소모하며, 4초 클립 생성은 15크레딧, 10초 클립은 30크레딧이 소모됩니다. 모든 길이의 비디오 편집은 40크레딧입니다. 월별 크레딧 할당량은 구독 등급에 따라 다릅니다.
  • 클립 길이 및 워터마크: 현재 클립 길이는 최대 10초로 제한되어 있으며, 모든 Omni 출력에는 Google의 SynthID와 C2PA 콘텐츠 자격 증명이 포함된 워터마크가 적용됩니다. 다운로드한 파일에는 추가적인 보이는 워터마크가 있을 수 있습니다.
  • 개발자 API: 현재 개발자/기업용 API는 출시되지 않았으며, 향후 몇 주 안에 공개될 예정입니다.

시사점

Gemini Omni의 대화형 편집 워크플로우는 반복적인 비디오 수정 작업의 효율성을 크게 향상시킬 잠재력을 지니고 있으며, 개발자 API 출시와 함께 더 광범위한 적용이 기대됩니다.

원문 읽기 →
원문을 불러오는 중...

댓글

GitHub Discussions