Skip to main content

即梦数字人视频生成 API

POST https://api.acedata.cloud/dreamina/videos 音频驱动的数字人口播视频生成(OmniHuman 1.5)。提供一张人物照片和一段驱动音频,生成人物开口说话、口型同步的视频。

请求头

请求参数

输入建议

  • 图片:清晰、光线良好的正面人像效果最佳;人脸无遮挡、在画面中占比适中。
  • 音频:mp3/wav,需公网可达。建议时长控制在 60 秒以内(1080p 建议 ≤30 秒,720p ≤60 秒)。
  • image_url 与 audio_url 都必须能被公网访问。

响应示例

异步与查询

接口默认同步返回最终视频。对于较长任务,可使用两种异步模式之一:
  • 传入 callback_url:接口立即返回 task_id,结果生成后回调该地址。
  • 传入 async: true:接口立即返回 task_id,再通过 POST /dreamina/tasks(免费)按 task_id 或 trace_id 轮询结果。
轮询契约详见 Dreamina Tasks API。

错误处理

计费

按生成视频时长计费,最大套餐约 ¥1/秒(如 10 秒视频约 ¥10)。