Skip to main content
POST

簡介

Veo 是 Google Vertex AI 推出的多模態視訊生成模型,支援 文生視訊(T2V)、 首幀約束 與 首尾幀約束(僅 3.1 系列)生成連貫視訊。透過 MixRoute 視訊 API 呼叫:先 提交任務 取得 task_id,再 查詢任務 輪詢狀態並取得結果。

認證

Bearer Token,如 Bearer sk-xxxxxxxxxx

支援的模型

呼叫流程

  1. 提交任務POST /v1/video/generations,傳入 modelprompt 及 Veo 專用參數。
  2. 輪詢狀態GET /v1/video/generations/{task_id},直到 statussucceededfailed
  3. 取得結果:成功時回應中的 url 為視訊資料(Veo 可能為 data:video/mp4;base64,... 或 OSS 連結)。

Veo 專用參數

string
required
視訊生成提示詞,描述畫面與動作。
integer
視訊時長(秒),支援:468
string
寬高比,僅支援:16:99:16
string
解析度:720p1080p
string
首幀參考圖(URL 或 Base64),用於圖生視訊/首幀約束。
string
尾幀參考圖(僅 veo-3.1 系列支援),與首幀配合實現首尾幀約束。
boolean
是否生成同步音訊。快速版模型會忽略該參數並始終包含音訊。
integer
每次生成的視訊數量,範圍 1-4
更多參數(如 personGenerationaddWatermarkseed)見 提交視訊任務

請求範例

完整請求/回應說明與多模型對比請參見 提交視訊任務查詢視訊任務