text | string | نعم | النص المراد تركيبه، يجب أن يكون سلسلة غير فارغة. |
format | string | لا | تنسيق الصوت الناتج، يمكن اختيار mp3 (افتراضي)، wav، pcm。wav و pcm كلاهما يعودان في حاوية WAV. opus غير مدعوم، إذا تم تمريره سيتم إرجاع 400 مباشرة. |
reference_id | string | string[] | لا | معرف صوت مستنسخ (يمكن إنشاؤه بواسطة Fish Model API أو استرجاعه في Fish Model Query). |
references | object[] | لا | عينات مرجعية مضمنة، الهيكل مطابق للمصدر، كل عنصر يحتوي على audio و text。مع reference_id أحدهما فقط. |
sample_rate | integer | لا | معدل العينة، الشائع هو 16000، 22050، 44100。format=mp3 الافتراضي هو 44100。 |
mp3_bitrate | integer | لا | معدل بت MP3، يمكن اختيار 64، 128، 192。يعمل فقط مع format=mp3。 |
prosody | object | لا | تغطية الإيقاع، تدعم speed (سرعة الكلام، 1.0 هي السرعة الأصلية) و volume (زيادة الصوت dB). على سبيل المثال {"speed":1.2,"volume":0}。 |
chunk_length | integer | لا | طول الشظايا من المصدر، الافتراضي يحدده المصدر. |
temperature | number | لا | درجة حرارة العينة، تتراوح تقريبًا من 0.0 إلى 1.0。 |
top_p | number | لا | معلمة عينة top-p. |
latency | string | لا | normal أو balanced، الافتراضي يتم تعيينه تلقائيًا إلى normal (إذا تم تمرير سلسلة فارغة، سيرفض المصدر الطلب). |
normalize | boolean | لا | هل يجب تطبيع النص. |
callback_url | string | لا | عنوان رد غير متزامن، انظر أدناه “الرد غير المتزامن”. هذا هو امتداد بالنسبة للواجهة الرسمية。 |