即夢數字人視頻生成 API
POST https://api.acedata.cloud/dreamina/videos
音頻驅動的數字人口播視頻生成(OmniHuman 1.5)。提供一張人物照片和一段驅動音頻,生成人物開口說話、口型同步的視頻。
請求頭
請求參數
輸入建議
- 圖片:清晰、光線良好的正面人像效果最佳;人臉无遮挡、在畫面中占比適中。
- 音頻:mp3/wav,需公網可達。建議時長控制在 60 秒以內(1080p 建議 ≤30 秒,720p ≤60 秒)。
image_url與audio_url都必須能被公網訪問。
響應示例
異步與查詢
接口默認同步返回最終視頻。對於較長任務,可使用兩種異步模式之一:- 傳入
callback_url:接口立即返回task_id,結果生成後回調該地址。 - 傳入
async: true:接口立即返回task_id,再通過POST /dreamina/tasks(免費)按task_id或trace_id輪詢結果。

