즉몽 디지털 인물 비디오 생성 API
POST https://api.acedata.cloud/dreamina/videos
오디오 기반의 디지털 인물 구술 비디오 생성(OmniHuman 1.5). 인물 사진과 드라이브 오디오를 제공하여 인물이 입을 열고 말하는, 입 모양이 동기화된 비디오를 생성합니다.
요청 헤더
요청 파라미터
입력 제안
- 사진: 선명하고 조명이 좋은 정면 인물 사진이 최적; 얼굴이 가려지지 않고 화면에서 적당한 비율을 차지해야 합니다.
- 오디오: mp3/wav, 공개적으로 접근 가능해야 합니다. 권장 길이는 60초 이내(1080p는 ≤30초, 720p는 ≤60초).
image_url과audio_url은 모두 공개적으로 접근 가능해야 합니다.
응답 예시
비동기 및 조회
인터페이스는 기본적으로 최종 비디오를 동기적으로 반환합니다. 긴 작업의 경우 두 가지 비동기 모드 중 하나를 사용할 수 있습니다:callback_url을 전달: 인터페이스가 즉시task_id를 반환하며, 결과 생성 후 해당 주소로 콜백합니다.async: true를 전달: 인터페이스가 즉시task_id를 반환하며, 이후POST /dreamina/tasks(무료)를 통해task_id또는trace_id로 결과를 폴링합니다.

