即夢デジタル人動画生成 API
POST https://api.acedata.cloud/dreamina/videos
音声駆動のデジタル人口播動画生成(OmniHuman 1.5)。人物の写真と一段の駆動音声を提供し、人物が口を開けて話す、口の動きが同期した動画を生成します。
リクエストヘッダー
リクエストパラメータ
入力の推奨
- 画像:鮮明で光の良い正面の肖像が最適;顔が隠れず、画面内で適度に占めること。
- 音声:mp3/wav、公開アクセス可能であること。推奨の長さは60秒以内(1080pは≤30秒、720pは≤60秒)。
image_urlとaudio_urlはどちらも公開アクセス可能でなければなりません。
レスポンス例
非同期とクエリ
インターフェースはデフォルトで最終動画を同期的に返します。長いタスクの場合、次の2つの非同期モードのいずれかを使用できます:callback_urlを入力:インターフェースは即座にtask_idを返し、結果生成後にこのアドレスにコールバックします。async: trueを入力:インターフェースは即座にtask_idを返し、その後POST /dreamina/tasks(無料)でtask_idまたはtrace_idによって結果をポーリングします。

