Skip to main content
تسمح لنا SUNO بإنشاء شخصيات صوتية مخصصة من خلال أي ملف صوتي، مما يتيح استنساخ الصوت لأغراض إنشاء الموسيقى. على عكس واجهة برمجة التطبيقات Persona الحالية (التي تستخدم audio_id الذي تم إنشاؤه بواسطة Suno)، تقبل هذه الواجهة عنوان URL صوتي عام يمكن الوصول إليه، وهو تسجيل صوتك الخاص. تشرح هذه الوثيقة كيفية دمج واجهة برمجة التطبيقات لاستنساخ الصوت.

الخطوة الأولى: إنشاء شخصية صوتية

تحتوي هذه الواجهة على ثلاثة معلمات إدخال: audio_url (إلزامي)، وهو عنوان URL لملف صوتي بتنسيق MP3 أو WAV يمكن الوصول إليه بشكل عام، ويحتوي على صوت شخص واحد واضح؛ وname وdescription (اختياري)، وهما اسم ووصف الشخصية الصوتية.
متطلبات ملف الصوت
  • يجب أن يكون تنسيق الصوت WAV أو MP3
  • يجب أن تتراوح مدة الصوت بين 10~240 ثانية، يُوصى باستخدام مواد صوتية نظيفة تتراوح بين 30~60 ثانية
  • يجب أن يحتوي الصوت على حديث أو غناء واضح وقابل للتعرف عليه من شخص واحد
  • يجب تجنب الضوضاء الخلفية، والموسيقى المصاحبة، والصدى، والارتجاع؛ الأغاني الكاملة المصحوبة عادة لا يمكن أن تمر عبر التحقق من بصمة الصوت
  • لا يجب أن تحتوي على أكثر من متحدث واحد أو أصوات متعددة
  • المواد ذات الصوت المنخفض جدًا، أو الكلام غير الواضح، أو الضوضاء الزائدة قد تؤدي إلى فشل الاستنساخ أو نتائج ضعيفة ملاحظات حول قيود الاستخدام
  • الشخصية الصوتية التي تم إنشاؤها عن طريق تحميل الصوت هي موارد خاصة
  • هذه الشخصية الصوتية لا تدعم إعادة الاستخدام عبر الحسابات
  • يُنصح باستخدامها في أقرب وقت بعد إنشائها، حيث قد يحدث فقدان أو عدم توفر إذا لم يتم استخدامها لفترة طويلة
  • الاسم المعاد هو تلقائي من النظام، يرجى الاعتماد على persona_id المعاد
يرجى إعادة المحاولة عند فشل الاستدعاء يعتبر استنساخ الصوت مهمة كثيفة الاستخدام للموارد، حتى مع توافق المواد تمامًا، هناك احتمال معين للفشل العرضي، مثل العودة الشائعة voices_sound_different (فشل التحقق من بصمة الصوت). هذا النوع من الفشل لا يتعلق بجودة الصوت، وعادة ما يمكن أن تنجح إعادة المحاولة باستخدام نفس المادة، يُنصح بتنفيذ 1~2 محاولة تلقائية عند الدمج. الطلبات الفاشلة لن يتم احتسابها.
العنوان https://cdn.acedata.cloud/suno_demo.mp3 هو مادة نموذجية يمكن استدعاؤها مباشرة (MP3، 41 ثانية، صوت شخص واحد). إذا كنت بحاجة إلى مثال بتنسيق WAV، يمكنك استخدام https://cdn.acedata.cloud/uploads/82d23b97-ec1c-4b41-91b8-989fc51f8765 (WAV، 41 ثانية، أحادي 44.1kHz).
النتيجة كما يلي:
يمكنك أن ترى أن حقل persona_id في data هو معرف الشخصية الصوتية التي تم إنشاؤها. حقل is_public دائمًا false، لأن الشخصية الصوتية التي تم إنشاؤها عن طريق تحميل الصوت هي خاصة. لاحظ أن الاسم المعاد هو تلقائي من النظام، يرجى استخدام persona_id للإشارة إلى هذه الشخصية الصوتية لاحقًا.

الخطوة الثانية: استخدام الشخصية الصوتية لإنشاء الموسيقى

بعد الحصول على معرف الشخصية الصوتية، يمكننا استخدام واجهة برمجة تطبيقات إنشاء الصوتيات من Suno لإنشاء الموسيقى. قم بتعيين action إلى generate، وقم بتعيين persona_id إلى معرف الشخصية الصوتية المعاد أعلاه، ستستخدم الأغاني الناتجة الصوت المستنسخ في الغناء.
ملاحظة: استنساخ الصوت يدعم فقط النماذج chirp-v4-5 وما فوق (مثل chirp-v4-5، chirp-v5، chirp-v5-5)، ولا يدعم chirp-v4.
النتيجة كما يلي:
يمكنك أن ترى أن الأغنية الناتجة استخدمت الصوت المستنسخ في الغناء. يمكن أيضًا استخدام persona_id مع إجراء cover لإعادة غناء الأغاني الموجودة باستخدام الصوت المستنسخ.