Skip to main content
بنقرة واحدة، حوّل صورة واحدة + مقطعًا صوتيًا واحدًا إلى «فيديو ناطق». تُكمل الخدمة داخليًا خطوتين تلقائيًا: أولًا استخدام image2video لتحريك الصورة، ثم استخدام lip-sync لمزامنة حركة الشفاه مع الصوت. ما عليك سوى إجراء استدعاء واحد.
  • عنوان الواجهة: POST https://api.acedata.cloud/kling/talking-photo
  • الفوترة: حسب المدة، 5 ثوانٍ 16.45 Credits، و10 ثوانٍ 30.45 Credits (= السعر المدمج لـ image2video + lip-sync)

رؤوس الطلب

معلمات الطلب

مثال للطلب

مثال للاستجابة

ملاحظات

  • يُنصح بأن تكون الصورة واضحة، بوجه أمامي، ولشخص واحد.
  • يُنصح ألا تتجاوز مدة الصوت مدة الفيديو (5 ثوانٍ/10 ثوانٍ).
  • تتم الفوترة عند النجاح؛ لا تتم الفوترة عند فشل التحقق من المعلمات (4xx).
  • يستغرق الإنشاء حوالي 4–6 دقائق (خطوتان)، ويُنصح باستخدام async=true + استطلاع /kling/tasks.