即梦数字人视频生成 API
POST https://api.acedata.cloud/dreamina/videos
音频驱动的数字人口播视频生成(OmniHuman 1.5)。提供一张人物照片和一段驱动音频,生成人物开口说话、口型同步的视频。
请求头
请求参数
输入建议
- 图片:清晰、光线良好的正面人像效果最佳;人脸无遮挡、在画面中占比适中。
- 音频:mp3/wav,需公网可达。建议时长控制在 60 秒以内(1080p 建议 ≤30 秒,720p ≤60 秒)。
image_url与audio_url都必须能被公网访问。
响应示例
异步与查询
接口默认同步返回最终视频。对于较长任务,可使用两种异步模式之一:- 传入
callback_url:接口立即返回task_id,结果生成后回调该地址。 - 传入
async: true:接口立即返回task_id,再通过POST /dreamina/tasks(免费)按task_id或trace_id轮询结果。

