Skip to main content
تسمح لنا SUNO بإنشاء شخصيات صوتية مخصصة من خلال أي ملف صوتي، مما يتيح استنساخ الصوت لاستخدامه في إنشاء الموسيقى. على عكس واجهة برمجة التطبيقات Persona الحالية (التي تستخدم audio_id الذي تم إنشاؤه بواسطة Suno)، تقبل هذه الواجهة عنوان URL صوتي عام يمكن الوصول إليه، وهو تسجيل صوتك الخاص. تشرح هذه الوثيقة كيفية دمج واجهة برمجة تطبيقات استنساخ الصوت.

الخطوة الأولى: إنشاء شخصية صوتية

تحتوي هذه الواجهة على ثلاثة معلمات إدخال: audio_url (إلزامي)، وهو عنوان URL لملف صوتي بتنسيق MP3 أو WAV يمكن الوصول إليه بشكل عام، ويحتوي على صوت شخص واحد واضح؛ وname وdescription (اختياري)، وهما اسم ووصف الشخصية الصوتية.
متطلبات ملف الصوت
  • يجب أن يكون تنسيق الصوت WAV أو MP3
  • يجب أن تتراوح مدة الصوت بين 10~240 ثانية، يُوصى باستخدام مواد صوتية نظيفة تتراوح بين 30~60 ثانية
  • يجب أن يحتوي الصوت على حديث أو غناء واضح وقابل للتعرف عليه من شخص واحد
  • يجب تجنب الضوضاء الخلفية، والموسيقى المصاحبة، والصدى، والانعكاس؛ عادةً ما لا يمكن التحقق من الصوت الكامل مع الموسيقى المصاحبة
  • لا يجب أن يحتوي على أكثر من متحدث واحد أو أصوات متعددة
  • قد تؤدي المواد ذات الصوت المنخفض جدًا، أو الكلام غير الواضح، أو الضوضاء الزائدة إلى فشل الاستنساخ أو نتائج ضعيفة ملاحظات حول قيود الاستخدام
  • الشخصية الصوتية التي تم إنشاؤها عن طريق تحميل الصوت هي موارد خاصة
  • هذه الشخصية الصوتية لا تدعم إعادة الاستخدام عبر الحسابات
  • يُنصح باستخدامها في أقرب وقت بعد إنشائها، حيث قد يحدث فقدان أو عدم توفر إذا لم يتم استخدامها لفترة طويلة
  • يتم إنشاء name تلقائيًا بواسطة النظام، يرجى الاعتماد على persona_id المعاد
يرجى إعادة المحاولة عند فشل الاستدعاء يعتبر استنساخ الصوت مهمة كثيفة الاستخدام للموارد، حتى إذا كانت المواد متوافقة تمامًا، فهناك احتمال معين للفشل العرضي، مثل voices_sound_different (فشل التحقق من الصوت). هذا النوع من الفشل لا يتعلق بجودة الصوت، وعادةً ما يمكن أن تنجح المحاولة مرة أخرى باستخدام نفس المواد، يُنصح بتنفيذ 1~2 محاولة تلقائية عند التكامل. لن يتم احتساب الطلبات الفاشلة.
العنوان https://cdn.acedata.cloud/suno_demo.mp3 هو مادة نموذجية يمكن استدعاؤها مباشرة (MP3، 41 ثانية، صوت شخص واحد). إذا كنت بحاجة إلى مثال بتنسيق WAV، يمكنك استخدام https://cdn.acedata.cloud/uploads/82d23b97-ec1c-4b41-91b8-989fc51f8765 (WAV، 41 ثانية، أحادي 44.1kHz).
النتيجة كما يلي:
يمكنك أن ترى أن حقل persona_id في data هو معرف الشخصية الصوتية التي تم إنشاؤها. يظل حقل is_public دائمًا false، لأن الشخصية الصوتية التي تم إنشاؤها عن طريق تحميل الصوت هي خاصة. لاحظ أن name المعاد هو تلقائي من النظام، يرجى استخدام persona_id للإشارة إلى هذه الشخصية الصوتية لاحقًا.

الخطوة الثانية: استخدام الشخصية الصوتية لإنشاء الموسيقى

بعد الحصول على معرف الشخصية الصوتية، يمكننا استخدام واجهة برمجة تطبيقات إنشاء الصوتيات من Suno لإنشاء الموسيقى. قم بتعيين action إلى generate، وقم بتعيين persona_id إلى معرف الشخصية الصوتية المعاد أعلاه، ستستخدم الأغاني الناتجة الصوت المستنسخ في الغناء.
ملاحظة: يدعم استنساخ الصوت فقط النماذج chirp-v4-5 وما فوق (مثل chirp-v4-5، chirp-v5، chirp-v5-5)، ولا يدعم chirp-v4.
النتيجة كما يلي:
يمكنك أن ترى أن الأغاني الناتجة استخدمت الصوت المستنسخ في الغناء. يمكن أيضًا استخدام persona_id مع إجراء cover لإعادة غناء الأغاني الموجودة باستخدام الصوت المستنسخ.