Gemini 视频生成
同一入口/gemini/video/generate 同时支持 Veo 与 Omni,用 model 区分。公共字段一致,但不要混用对方的图数 / 时长规则。升清、延长、重拍、物体编辑仅适用于 Veo。
支持的模型
功能特性
文生视频
通过
action: "text2video" 从文本提示词创建视频图生视频
Veo:1–2 张(首帧 / 首+尾帧)。Omni:1–7 张参考图
Ingredients 合成视频
仅 Veo:1–3 张引导图,设置
action: "ingredients2video"Omni Flash
同一生成接口,传
model: "omni-flash",时长 3–10 秒超分与延长
提升到 1080p/4K、生成 GIF 或延长视频时长(Veo)
重拍与物体编辑
更换摄像机运动,或通过蒙版插入/移除物体(Veo)
使用流程
1
创建视频任务
调用
POST /gemini/video/generate,传入提示词和模型,返回 taskId。2
轮询任务结果
使用
GET /gemini/task/result?taskId=xxx 轮询直到 status 为 completed,结果中包含视频 URL。3
二次处理(可选,仅 Veo)
使用返回的
videoId 进行超分、延长、重拍或物体编辑。升清 / GIF 请走 /video/upsample,不要用生成接口。生成规则
公共字段:prompt 必填(建议英文)、action、aspectRatio(默认 16:9 / 9:16)。
Veo(veo31_fast / veo31_quality)
3 张引导图说明:
- 对外仍写
model=veo31_fast+action=ingredients2video(兼容旧 modelveo31_fast_ingredients) veo31_fast本身只支持最多 2 张首/尾帧;3 张由服务端改走支持参考图的 Veo 3.1- 上游 3 张参考图只接受 8 秒,传 4/6 会直接 400
veo3_fast / veo3_quality 会自动映射为 veo31_*。可选 generate_audio、resolution(如 720p / 1080p),仅对 Veo 生效。
Omni(omni-flash)
Omni 不支持
ingredients2video。generate_audio / resolution 对 Omni 无效。