Gemini Omni Flash AI 视频生成器

当你需要把文字、图片参考和视频编辑放进同一个快速多模态视频流程时,可以使用 Gemini Omni Flash。

0 / 5000
模型介绍

Gemini Omni Flash 文本、图片与视频参考生成

用文字、单张图片、多张参考图或一个输入视频来生成 720p AI 视频。Gemini Omni Flash 适合快速完成多模态视频草稿、参考图驱动视频和视频编辑。

支持文字、单图、多图和视频输入
720p 输出,支持 16:9 与 9:16
非编辑模式支持 3-10 秒
主推型号

Gemini Omni Flash

模型
Gemini Omni Flash
比例
16:9 / 9:16
分辨率
720p
时长
3-10s

核心优势

  • 没有素材时,可以直接用纯文字快速生成视频草稿。
  • 有单张图片时,可以做图生视频;有多张参考图时,可以用提示词指定每张图的角色。
  • 已有视频时,可以用文字描述编辑方向,让源视频按指令变化。

适用场景

  • 角色动作测试、氛围场景、短视频草稿和故事板。
  • 需要多张参考图保持主体、风格或场景一致的创意任务。
  • 已有视频素材并希望快速做风格、场景或动作编辑的工作流。

提示词与工作流建议

  • 参考生视频时使用 <IMAGE_REF_0>、<IMAGE_REF_1> 这类标记,明确每张图片的用途。
  • 每次生成尽量只描述一个核心动作或编辑目标。
  • 视频编辑模式适合保留源视频的节奏和构图,只改变你在提示词里说明的内容。

如何使用 Gemini Omni Flash

  1. 01写下场景、动作、镜头运动或编辑目标。
  2. 02按需上传一张图片、多张参考图,或一个视频源文件。
  3. 03选择 16:9 或 9:16,保持 720p;非编辑模式选择 3-10 秒。
  4. 04生成后检查主体一致性和运动清晰度,再调整提示词或参考素材。

Gemini Omni Flash 提示词指南

把素材来源、运动或编辑目标、画面风格和限制条件写清楚,生成结果会更容易判断和迭代。

提示词模板
来源: 纯文字、单图、多图 <IMAGE_REF_0> 标记,或一个输入视频
运动: 一个清晰的动作、镜头运动、转场或编辑指令
风格: 电影感、编辑、社媒、纪录片、音乐视频或故事板方向
限制: 保持主体一致,避免不可读文字,让运动保持聚焦
01

文字生成雨夜街景

描述你想生成的内容
生成 5 秒雨夜城市街景,一位穿长风衣的人穿过霓虹倒影的路面,镜头缓慢向前推进,柔和轮廓光,空气中有细小雨雾,电影感短视频风格。

Gemini Omni Flash 推荐设置

先用较短时长验证方向,只有动作需要更多时间时再增加秒数。

Gemini Omni Flash

文生视频草稿

适合快速探索场景、镜头和短片创意。

比例
16:9 或 9:16
分辨率
720p
时长
3-5s
Gemini Omni Flash

图片或多图参考

单图适合图生视频,多图适合让不同参考图承担主体、风格或场景角色。

比例
匹配发布渠道
分辨率
720p
时长
5-8s
Gemini Omni Flash

视频编辑

上传一个视频并描述编辑目标,价格按输入视频时长预估。

分辨率
720p

相关工具

此工具使用第三方模型能力,除非明确说明,否则与原模型提供方没有从属或背书关系。

常见问题

Gemini Omni Flash 支持哪些输入?+

当前页面支持纯文字生视频、单图生视频、多图参考生视频,以及单个视频的文字编辑。

支持哪些比例和分辨率?+

当前接入提供 720p 输出,并支持 16:9 和 9:16。

如何在提示词里引用上传的图片?+

使用 <IMAGE_REF_0>、<IMAGE_REF_1> 这样的标记。编辑器会根据已上传图片自动插入这些 token。

Gemini Omni Flash 如何计费?+

纯文字按官方文生视频秒级价格预估;带图片或视频输入按多模态秒级价格预估;视频编辑按输入视频时长计费。

相关文章