Skip to main content

Veo-3 视频生成示例

以下示例展示如何使用 Veo-3模型生成高质量的视频内容。Veo-3是Google最新的视频生成模型,支持高分辨率、长时长的视频生成。

快速开始

支持的参数

Instance 参数

Configuration 参数

  • aspectRatio: 视频宽高比(“16:9” 默认、“9:16”)
  • durationSeconds: 视频时长(4、6、8秒)。使用1080p/4k、扩展或参考图片时必须为8秒
  • resolution: 视频分辨率(“720p” 默认、“1080p”、“4k”)。4k不支持Lite版本;扩展功能仅支持720p
  • sampleCount: 生成视频数量(1-4)
  • seed: 随机种子(0-4,294,967,295),用于可重复生成
  • enhancePrompt: 是否使用 Gemini 优化提示词(默认true,建议保持)
  • generateAudio: 是否生成音频(true/false)。Veo 3 特色,支持同步对话和音效
  • negativePrompt: 负向提示词,描述不希望出现的内容
  • compressionQuality: 压缩质量(“optimized” 默认、“lossless”)
  • personGeneration: 人物生成控制。文生视频和扩展支持”allow_all”,图生视频、插帧和参考图片仅支持”allow_adult”

音频提示词示例

Veo 3 支持在 prompt 中描述音频内容:

各版本功能差异

图片参考生成

Veo 支持多种图片参考方式来引导视频生成:

图片参数类型

referenceType 可选值
  • ASSET - 提供资产(场景、物体、角色等),视频会参考图片中的内容
  • STYLE - 提供风格(颜色、光照、纹理等),视频会参考图片的视觉风格
重要限制:ASSET 和 STYLE 不能在同一请求中同时使用,只能选择一种类型。

多参考图片示例

使用 referenceImages 参数可以传入最多 3 张参考图片来引导视频生成的风格和内容:

首尾帧插值示例

使用 image(首帧)和 lastFrame(尾帧)参数可以精确控制视频的开始和结束画面:

轮询接口说明

路径格式
注意:提交任务返回的 name 字段即为完整的轮询路径,可直接使用。 兼容说明:GET 查询可以不带 Content-Type。官方 Google SDK 即使保留 Content-Type: application/json 且发送空 body,Router 也会正常处理。
建议轮询间隔: 15秒,视频生成通常需要 30秒-5分钟。

图片参考使用限制

视频生成流程

  1. 提交任务: 发送predictLongRunning请求,获得操作名称
  2. 等待处理: 轮询操作状态直到完成
  3. 下载视频: 从响应中提取视频数据并保存

响应示例

任务提交响应

状态查询响应(进行中)

状态查询响应(完成)