Skip to main content

即夢數字人視頻生成 API

POST https://api.acedata.cloud/dreamina/videos 音頻驅動的數字人口播視頻生成(OmniHuman 1.5)。提供一張人物照片和一段驅動音頻,生成人物開口說話、口型同步的視頻。

請求頭

請求參數

輸入建議

  • 圖片:清晰、光線良好的正面人像效果最佳;人臉无遮挡、在畫面中占比適中。
  • 音頻:mp3/wav,需公網可達。建議時長控制在 60 秒以內(1080p 建議 ≤30 秒,720p ≤60 秒)。
  • image_url 與 audio_url 都必須能被公網訪問。

響應示例

異步與查詢

接口默認同步返回最終視頻。對於較長任務,可使用兩種異步模式之一:
  • 傳入 callback_url:接口立即返回 task_id,結果生成後回調該地址。
  • 傳入 async: true:接口立即返回 task_id,再通過 POST /dreamina/tasks(免費)按 task_id 或 trace_id 輪詢結果。
輪詢契約詳見 Dreamina Tasks API。

錯誤處理

計費

按生成視頻時長計費,最大套餐約 ¥1/秒(如 10 秒視頻約 ¥10)。