텍스트, 이미지, 참조 사진 입력부터 비디오 편집까지 아우르는 스마트 멀티모달 영상 생성 워크플로우.
프롬프트, 시작 프레임 이미지, 여러 참조 사진 또는 원본 비디오를 업로드합니다
텍스트 기획안, 이미지 소스 또는 이미 존재하는 비디오를 가져와 모델에 시각적 정보를 전달합니다.
원하는 비디오의 동작이나 편집 지시 사항을 자연어로 작성합니다
피사체의 행동, 카메라 워크, 화면 분위기, 추가할 효과 등을 한글 텍스트로 자유롭게 설명합니다.
화면 비율 및 해상도 등의 출력 설정을 선택합니다
인스타그램 릴스, 광고 소재, 기획 콘티 등 퍼블리싱 용도에 맞춰 규격을 조정합니다.
비디오를 생성하고, 화면을 검토한 뒤 디테일을 수정합니다
클라우드 렌더링을 진행하고 일관성을 확인한 뒤, 텍스트나 참조 자료를 보완하여 완성도를 높입니다.
프롬프트, 시작 프레임 이미지, 여러 참조 사진 또는 원본 비디오를 업로드합니다
텍스트 기획안, 이미지 소스 또는 이미 존재하는 비디오를 가져와 모델에 시각적 정보를 전달합니다.
원하는 비디오의 동작이나 편집 지시 사항을 자연어로 작성합니다
피사체의 행동, 카메라 워크, 화면 분위기, 추가할 효과 등을 한글 텍스트로 자유롭게 설명합니다.
화면 비율 및 해상도 등의 출력 설정을 선택합니다
인스타그램 릴스, 광고 소재, 기획 콘티 등 퍼블리싱 용도에 맞춰 규격을 조정합니다.
비디오를 생성하고, 화면을 검토한 뒤 디테일을 수정합니다
클라우드 렌더링을 진행하고 일관성을 확인한 뒤, 텍스트나 참조 자료를 보완하여 완성도를 높입니다.
기존의 AI 비디오 작업에서는 텍스트, 이미지, 비디오, 참조 사진 등 다차원 입력을 하나의 모델에 동시에 이해시키고 일관되게 정렬하는 것이 매우 어려웠습니다.

Gemini Omni Flash는 프롬프트, 이미지, 참조 사진, 비디오를 매끄럽게 연결하여 일원화된 생성 및 지능형 편집 시스템을 선보집니다.
Gemini Omni Flash는 창작자에게 전례 없는 유연함을 선사하여, 비디오 생성, 설정 튜닝, 특수 효과 적용을 손쉽게 수행하도록 돕습니다.