Skip to main content

Gemini 视频生成

同一入口 /gemini/video/generate 同时支持 VeoOmni,用 model 区分。公共字段一致,但不要混用对方的图数 / 时长规则。升清、延长、重拍、物体编辑仅适用于 Veo。

支持的模型

功能特性

文生视频

通过 action: "text2video" 从文本提示词创建视频

图生视频

Veo:1–2 张(首帧 / 首+尾帧)。Omni:1–7 张参考图

Ingredients 合成视频

仅 Veo:1–3 张引导图,设置 action: "ingredients2video"

Omni Flash

同一生成接口,传 model: "omni-flash",时长 3–10 秒

超分与延长

提升到 1080p/4K、生成 GIF 或延长视频时长(Veo)

重拍与物体编辑

更换摄像机运动,或通过蒙版插入/移除物体(Veo)

使用流程

1

创建视频任务

调用 POST /gemini/video/generate,传入提示词和模型,返回 taskId
2

轮询任务结果

使用 GET /gemini/task/result?taskId=xxx 轮询直到 status 为 completed,结果中包含视频 URL。
3

二次处理(可选,仅 Veo)

使用返回的 videoId 进行超分、延长、重拍或物体编辑。升清 / GIF 请走 /video/upsample,不要用生成接口。

生成规则

公共字段:prompt 必填(建议英文)、actionaspectRatio(默认 16:9 / 9:16)。

Veo(veo31_fast / veo31_quality

3 张引导图说明:
  • 对外仍写 model=veo31_fast + action=ingredients2video(兼容旧 model veo31_fast_ingredients
  • veo31_fast 本身只支持最多 2 张首/尾帧;3 张由服务端改走支持参考图的 Veo 3.1
  • 上游 3 张参考图只接受 8 秒,传 4/6 会直接 400
veo3_fast / veo3_quality 会自动映射为 veo31_*。可选 generate_audioresolution(如 720p / 1080p),仅对 Veo 生效。

Omni(omni-flash

Omni 不支持 ingredients2videogenerate_audio / resolution 对 Omni 无效。

可用端点

生成

后处理

物体编辑

任务管理

视频与图像共用同一轮询端点 — 见获取任务结果

浏览 API 文档