Skip to main content
Змусьте наявне відео Kling (5 секунд або 10 секунд) “говорити” відповідно до аудіо або тексту — тобто синхронізувати губи (Lip Sync). У поєднанні з image2video у /kling/videos (щоб оживити фотографію) можна створити повний процес “фотографії, що говорять / цифрового ведучого”.
Цей інтерфейс є зручним однокроковим обгортанням, наданим AceDataCloud, для поширених сценаріїв, керованих аудіо/текстом; він не є дзеркалом полів багатокрокового офіційного інтерфейсу Kling «розпізнавання обличчя → Advanced Lip Sync». Будь ласка, керуйтеся таблицею параметрів на цій сторінці.
  • Адреса інтерфейсу:POST https://api.acedata.cloud/kling/lip-sync
  • Формат запиту:application/json
  • Формат відповіді:application/json
  • Тарифікація:кожен успішний виклик 2.45 Credits(фіксовано)

Заголовки запиту(Request Headers)

Параметри запиту(Request Body)

Приклади запитів

1)Керування аудіо(audio2video)

2)Керування текстом(text2video)

Приклад відповіді(синхронний успіх)

Асинхронний режим і запит

Коли передається callback_url або async: true, інтерфейс негайно повертає task_id; після цього можна:
  • Опитування:POST /kling/tasks,body { "action": "retrieve", "id": "<task_id>" }(безкоштовно)
  • Зворотний виклик:після завершення генерації результат надсилається POST-запитом на ваш callback_url

Повний процес:фотографія, що говорить(image2video → lip-sync)

Відповідь з помилкою

Примітки

  • video_id має бути згенерованим відео Kling протягом останніх 30 днів і мати тривалість 5 с або 10 с; інакше передайте відео, що відповідає обмеженням, через video_url.
  • Для вхідного відео рекомендується чітке обличчя анфас, одна людина — це забезпечує найкращий ефект синхронізації губ.
  • Тривалість аудіо/тексту має відповідати тривалості відео (аудіо не має перевищувати довжину відео).
  • Оплата стягується у разі успіху (2.45 Credits/раз); за помилки перевірки параметрів (4xx) оплата не стягується.