Skip to main content
Låt en befintlig Kling-video (5 sekunder eller 10 sekunder) “tala” enligt ljud eller text — dvs. läppsynka (Lip Sync). Tillsammans med image2video i /kling/videos (som får foton att röra sig) kan detta kopplas ihop till ett komplett flöde för “talande foton / digitala presentatörer”.
Detta API är en smidig enstegsförpackning från AceDataCloud, avsedd för vanliga ljud-/textdrivna scenarier; det är inte en fältspegel av Klings officiella flerstegsgränssnitt ”ansiktsigenkänning → Advanced Lip Sync”. Använd parametertabellen på denna sida som referens.
  • API-adress:POST https://api.acedata.cloud/kling/lip-sync
  • Begärandeformat:application/json
  • Svarsformat:application/json
  • Debitering:2.45 Credits per lyckat anrop (fast)

Begärandehuvuden (Request Headers)

Begärandeparametrar (Request Body)

Begärandeexempel

1)Ljuddrivet (audio2video)

2)Textdrivet (text2video)

Svarsexempel (synkront lyckat)

Asynkront läge och frågor

När callback_url eller async: true skickas, returnerar API:et omedelbart task_id; därefter kan du:
  • Polla: POST /kling/tasks, body { "action": "retrieve", "id": "<task_id>" } (gratis)
  • Återanrop: När genereringen är klar POST:as resultatet till din callback_url

Komplett flöde: Talande foto (image2video → lip-sync)

Felsvar

Obs!

  • video_id måste vara en Kling-video som genererats inom 30 dagar och vara 5 s eller 10 s; använd annars video_url för att skicka in en video som uppfyller begränsningarna.
  • Indatavideon bör ha ett tydligt ansikte framifrån och en person, för bästa läppsynkresultat.
  • Ljud-/textlängden bör matcha videolängden (ljudet får inte vara längre än videon).
  • Debitering sker vid lyckat resultat (2,45 Credits/gång); misslyckad parametervalidering (4xx) debiteras inte.