Skip to main content

즉몽 디지털 인물 비디오 생성 API

POST https://api.acedata.cloud/dreamina/videos 오디오 기반의 디지털 인물 구술 비디오 생성(OmniHuman 1.5). 인물 사진과 드라이브 오디오를 제공하여 인물이 입을 열고 말하는, 입 모양이 동기화된 비디오를 생성합니다.

요청 헤더

요청 파라미터

입력 제안

  • 사진: 선명하고 조명이 좋은 정면 인물 사진이 최적; 얼굴이 가려지지 않고 화면에서 적당한 비율을 차지해야 합니다.
  • 오디오: mp3/wav, 공개적으로 접근 가능해야 합니다. 권장 길이는 60초 이내(1080p는 ≤30초, 720p는 ≤60초).
  • image_url과 audio_url은 모두 공개적으로 접근 가능해야 합니다.

응답 예시

비동기 및 조회

인터페이스는 기본적으로 최종 비디오를 동기적으로 반환합니다. 긴 작업의 경우 두 가지 비동기 모드 중 하나를 사용할 수 있습니다:
  • callback_url을 전달: 인터페이스가 즉시 task_id를 반환하며, 결과 생성 후 해당 주소로 콜백합니다.
  • async: true를 전달: 인터페이스가 즉시 task_id를 반환하며, 이후 POST /dreamina/tasks(무료)를 통해 task_id 또는 trace_id로 결과를 폴링합니다.
폴링 계약에 대한 자세한 내용은 Dreamina Tasks API를 참조하십시오.

오류 처리

요금

생성된 비디오의 길이에 따라 요금이 부과되며, 최대 요금은 약 ¥1/초입니다(예: 10초 비디오 약 ¥10).