使用 Google Veo 3.1 AI 视频生成器 时,先写一份聚焦的镜头简报,明确相机如何移动,并把声音当作场景的一部分来描述。需要电影感画面、产品视觉,或同时重视运动、声音和输出分辨率时,Veo 3.1 是一个合适的选择。
OpenVideoMaker 提供 Veo 3.1 和 Veo 3.1 Fast。标准版本适合更精细的生成,Fast 适合快速探索概念。页面还支持参考图、画幅比例、分辨率、时长和音频设置,可以根据最终发布渠道调整生成参数。
如何使用 Veo 3.1 制作 AI 视频
1. 写提示词前先确定镜头
先确定主体、环境、相机位置、主要动作、情绪和输出用途。产品展示、风景建立镜头和社交广告需要不同的节奏与构图。首轮提示词只围绕一个可见动作,这样才能判断 Veo 是否理解了简报。
2. 用自然语言描述相机运动
可以使用“从中景缓慢推近到近景”“固定广角镜头”或“从桌面上方轻轻向下摇臂”等表达。把相机运动放在它所支持的动作附近。如果主体朝镜头走,说明相机是保持不动、向后跟拍,还是绕着主体移动。
3. 场景需要声音时加入音频方向
Veo 3.1 可以理解雨声、房间底噪、脚步声、对白或轻柔环境音乐等音频提示。描述声音以及它和动作的关系:“安静的咖啡馆环境声,杯子被放到桌面上,然后出现一句简短对白。”生成后单独检查音频,因为画面出色的视频也需要适合用途的声音。
4. 需要一致性时添加参考图
需要让产品、角色或环境保持视觉锚定时,可以上传最多三张参考图。选择主体清晰可见的图片。Veo 参考模式使用 8 秒时长,因此当参考一致性比更长片段更重要时再选择这个工作流。
5. 选择版本和输出设置
需要主要质量版本时选择 Veo 3.1,快速探索时选择 Veo 3.1 Fast。生成前设置画幅比例、分辨率、时长和音频选项。Veo 支持 720p 到 4K,但应根据发布渠道选择;社交媒体草稿不一定需要最大分辨率。
6. 同时检查画面和音频
检查第一帧、主要相机运动、主体一致性、动作时机和音频对齐。如果只有一个部分失败,就只修改提示词中的这一部分。例如构图漂移时缩短相机指令,主体没完成主要动作时删除次要动作。
Veo 3.1 实用提示词结构
可以按以下顺序构建提示词:
- 镜头和相机:构图、镜头感觉和运动。
- 主体:身份、材质、服装或产品特征。
- 动作:一个主要运动和预期结束状态。
- 环境:地点、时间、天气和背景行为。
- 光照和风格:光源、对比度、色彩和视觉质感。
- 音频:对白、音效、环境声或音乐方向。
例如:“日出时分,镜头缓慢推近木桌上的哑光黑色旅行杯。一只手进入画面拿起杯子,蒸汽在温暖的窗光中卷起。干净的商业写实风格,浅景深,柔和房间底噪,杯子轻轻碰到桌面的声音,不要让其他物体移动。”这段提示词给出了主体、动作、相机、画面和音频指令,同时避免互相竞争的故事线。
用 Veo 3.1 制作产品和社交视频
产品视频要写出材质、形状、表面反射和希望出现的单一产品动作。慢速旋转、打开瓶盖、布料运动或近距离展示,比一次生成多个产品互动更容易审核。必须保持物体可识别时,使用干净的产品参考图。
制作社交视频前先选择比例,并让主体保持在安全区域内。竖屏短视频和横向网站首图需要不同的构图。输出太长时,可以用 视频裁剪 删除多余时间;需要平台尺寸时使用 视频缩放。
Veo 3.1 与其他 AI 视频模型的区别
简报重点是电影感相机语言、音频方向或高分辨率输出时,可以选择 Veo。需要叙事场景和角色瞬间时使用 Sora 2,需要大量参考素材的运动流程时使用 Seedance,需要明确控制帧、图片和参考视频时使用 Kling。
如果还没有确定模型,可以从 AI 视频生成器中心 开始。比较模型时保持相同的主体、动作、比例和审核标准,这样结果反映的才是模型差异,而不是简报变化。
常见 Veo 3.1 提示词问题
相机没有按照指令运动
只使用一个相机运动,并明确方向和起始画面。与其罗列电影术语,不如写“从左向右缓慢横向跟拍”。如果动作比运动更重要,就进一步简化相机指令。
音频与画面不匹配
把音频提示写在触发它的事件旁边,并保持声音设计简短。先检查画面,再检查生成的音频。场景包含对白时写出对白并说明说话者;只需要氛围时,描述环境声音即可。
参考主体发生变化
使用背景干扰少的清晰参考图,并在提示词中重复最重要的身份或产品特征。减少移动主体数量,先测试短动作,再加入额外相机运动。
视频对发布渠道来说太大
选择适合发布界面的分辨率,然后裁掉多余时间。如果最终 MP4 仍超过限制,先完成画面审核,再使用 视频压缩 调整大小或压缩。
常见问题
如何使用 Google Veo 3.1 AI 视频生成器?
打开 Veo AI 视频生成器,写一份聚焦的镜头提示词,需要时添加最多三张参考图,选择 Veo 3.1 或 Fast 和输出设置,然后生成并检查片段。
Veo 3.1 和 Veo 3.1 Fast 有什么区别?
Veo 3.1 是偏向质量的主要版本,Veo 3.1 Fast 用于更快探索。可以先用 Fast 测试概念,简报稳定后再切换标准版本完成更精细的生成。
Veo 3.1 可以生成音频吗?
可以。工作流包含音频设置,提示词可以描述对白、环境声、音效或音乐方向。发布前要同时检查声音和画面。
Veo 可以使用多少张参考图?
最多可以上传三张参考图。Veo 参考模式使用 8 秒时长,因此只有当视觉锚定比更长片段更重要时才使用它。
Veo 3.1 支持什么分辨率?
OpenVideoMaker 页面提供从 720p 到 4K 的输出选项。选择能让主体和文字在目标渠道保持清晰的最小分辨率,只有必要时才制作更大的最终版本。
继续 Veo 工作流
从 Google Veo 3.1 AI 视频生成器 开始,再查看 图生视频提示词 获取相机和运动思路。故事或参考流程改变时,可以比较 Sora 2 和 Seedance,最后使用 视频裁剪、视频缩放 和 视频压缩 处理片段。