image2video de /kling/videos (pour animer une photo), elle permet de former un flux complet de « photo parlante / présentateur numérique ».
Cette interface est un encapsulage pratique en une étape fourni par AceDataCloud, destiné aux scénarios courants pilotés par audio/texte ; elle n’est pas un miroir des champs de l’interface officielle Kling en plusieurs étapes « reconnaissance faciale → Advanced Lip Sync ». Veuillez vous référer au tableau des paramètres de cette page.
- Adresse de l’interface :
POST https://api.acedata.cloud/kling/lip-sync - Format de requête :
application/json - Format de réponse :
application/json - Facturation : 2.45 Credits par appel réussi (fixe)
En-têtes de requête (Request Headers)
Paramètres de requête (Request Body)
Exemples de requêtes
1)Piloté par audio (audio2video)
2)Piloté par texte (text2video)
Exemple de réponse (succès synchrone)
Mode asynchrone et consultation
Lorsquecallback_url ou async: true est transmis, l’interface renvoie immédiatement task_id ; vous pouvez ensuite :
- Interroger :
POST /kling/tasks, body{ "action": "retrieve", "id": "<task_id>" }(gratuit) - Rappel : une fois la génération terminée, le résultat est envoyé par POST à votre
callback_url
Flux complet : photo parlante (image2video → lip-sync)
Réponse d’erreur
Remarques
video_iddoit être une vidéo Kling générée dans les 30 jours, et durer 5 s ou 10 s ; sinon, utilisezvideo_urlpour fournir une vidéo conforme aux contraintes.- Il est recommandé que la vidéo d’entrée montre un visage net de face, une seule personne, afin d’obtenir le meilleur effet de synchronisation labiale.
- La durée de l’audio/du texte doit correspondre à celle de la vidéo (l’audio ne doit pas dépasser la durée de la vidéo).
- La facturation a lieu en cas de succès (2,45 Credits/fois) ; les échecs de validation des paramètres (4xx) ne sont pas facturés.

