Skip to main content

API do generowania wideo z cyfrową postacią

POST https://api.acedata.cloud/dreamina/videos Generowanie wideo z cyfrową postacią napędzaną dźwiękiem (OmniHuman 1.5). Podaj zdjęcie postaci i fragment dźwięku, aby wygenerować wideo, w którym postać mówi i synchronizuje ruchy ust.

Nagłówki żądania

Parametry żądania

Sugestie dotyczące wejścia

  • Obraz: Wyraźne, dobrze oświetlone zdjęcie twarzy jest najlepsze; twarz nie powinna być zasłonięta, a jej proporcje w kadrze powinny być odpowiednie.
  • Dźwięk: mp3/wav, musi być dostępny publicznie. Zaleca się, aby czas trwania nie przekraczał 60 sekund (1080p zaleca się ≤30 sekund, 720p ≤60 sekund).
  • image_url i audio_url muszą być dostępne publicznie.

Przykład odpowiedzi

Asynchroniczność i zapytania

Interfejs domyślnie zwraca ostateczne wideo synchronizacyjnie. Dla dłuższych zadań można użyć jednego z dwóch trybów asynchronicznych:
  • Podaj callback_url: interfejs natychmiast zwraca task_id, a po wygenerowaniu wyników wywołuje ten adres.
  • Podaj async: true: interfejs natychmiast zwraca task_id, a następnie sprawdzaj wyniki za pomocą POST /dreamina/tasks (bezpłatnie) według task_id lub trace_id.
Szczegóły dotyczące umowy dotyczącej sprawdzania wyników znajdują się w Dreamina Tasks API.

Obsługa błędów

Rozliczenia

Opłaty są naliczane na podstawie długości generowanego wideo, maksymalny pakiet wynosi około ¥1/sekundę (np. wideo 10-sekundowe kosztuje około ¥10).