image2video у /kling/videos (щоб оживити фотографію) можна створити повний процес “фотографії, що говорять / цифрового ведучого”.
Цей інтерфейс є зручним однокроковим обгортанням, наданим AceDataCloud, для поширених сценаріїв, керованих аудіо/текстом; він не є дзеркалом полів багатокрокового офіційного інтерфейсу Kling «розпізнавання обличчя → Advanced Lip Sync». Будь ласка, керуйтеся таблицею параметрів на цій сторінці.
- Адреса інтерфейсу:
POST https://api.acedata.cloud/kling/lip-sync - Формат запиту:
application/json - Формат відповіді:
application/json - Тарифікація:кожен успішний виклик 2.45 Credits(фіксовано)
Заголовки запиту(Request Headers)
Параметри запиту(Request Body)
Приклади запитів
1)Керування аудіо(audio2video)
2)Керування текстом(text2video)
Приклад відповіді(синхронний успіх)
Асинхронний режим і запит
Коли передаєтьсяcallback_url або async: true, інтерфейс негайно повертає task_id; після цього можна:
- Опитування:
POST /kling/tasks,body{ "action": "retrieve", "id": "<task_id>" }(безкоштовно) - Зворотний виклик:після завершення генерації результат надсилається POST-запитом на ваш
callback_url
Повний процес:фотографія, що говорить(image2video → lip-sync)
Відповідь з помилкою
Примітки
video_idмає бути згенерованим відео Kling протягом останніх 30 днів і мати тривалість 5 с або 10 с; інакше передайте відео, що відповідає обмеженням, черезvideo_url.- Для вхідного відео рекомендується чітке обличчя анфас, одна людина — це забезпечує найкращий ефект синхронізації губ.
- Тривалість аудіо/тексту має відповідати тривалості відео (аудіо не має перевищувати довжину відео).
- Оплата стягується у разі успіху (2.45 Credits/раз); за помилки перевірки параметрів (4xx) оплата не стягується.

