Gemini Omni Flash 支持从文生视频、图生视频、多图参考到指令级视频编辑的完整多模态工作流。
上传提示词、首帧图像、多张参考图或源视频
准备好您的文字创意、初始帧、多角度参考照片或已有的源视频,以便模型拥有丰富的视觉上下文。
描述您期望的画面运动或剪辑方向
输入简单的中文指令,指引主体动作、摄像机运镜、画面质感、特效和最终的创意走向。
选择视频比例与输出生成参数
设定适合社交媒体、产品推介、广告投放或故事板展示的画面比例和导出配置。
生成、评审并微调最终生成的视频
渲染并预览您的多模态视频片段,若有不妥可快速微调文本描述或更换参考图重新生成。
上传提示词、首帧图像、多张参考图或源视频
准备好您的文字创意、初始帧、多角度参考照片或已有的源视频,以便模型拥有丰富的视觉上下文。
描述您期望的画面运动或剪辑方向
输入简单的中文指令,指引主体动作、摄像机运镜、画面质感、特效和最终的创意走向。
选择视频比例与输出生成参数
设定适合社交媒体、产品推介、广告投放或故事板展示的画面比例和导出配置。
生成、评审并微调最终生成的视频
渲染并预览您的多模态视频片段,若有不妥可快速微调文本描述或更换参考图重新生成。
普通的 AI 视频工作流很难让单个模型同时深入理解复杂的提示词、首帧图像、参考照片和已有视频剪辑。

Gemini Omni Flash 将文本提示词、图像、参考照片和上传的源视频无缝整合,开创了一体化的多维生成与编辑逻辑。
Gemini Omni Flash 为创作者提供了一种前所未有的灵活性,让您轻松驾驭多维视频生成、参数微调与智能编辑。