POST https://api.acedata.cloud/fish/model.
Jeśli potrzebujesz tymczasowo użyć dźwięku referencyjnego, nie musisz tworzyć modelu, możesz bezpośrednio użyćreferencesz Fish TTS API do jednorazowego klonowania. Aby przeszukać istniejące dźwięki, zapoznaj się z Fish Model Query API; aby wyszukać szczegóły pojedynczego dźwięku według_id, zapoznaj się z Fish Model Get API.
Proces aplikacji
Aby korzystać z Fish Model API, najpierw przejdź do konsoli Ace Data Cloud, aby uzyskać swój token API, który należy zachować na przyszłość.
Jeśli nie jesteś zalogowany lub zarejestrowany, automatycznie zostaniesz przekierowany na stronę logowania, aby zarejestrować się i zalogować, a po zakończeniu zostaniesz automatycznie przekierowany z powrotem na bieżącą stronę.
Jeden token API wystarczy do korzystania ze wszystkich usług platformy, nie ma potrzeby składania osobnych wniosków dla każdej usługi. Przy pierwszym wniosku otrzymasz darmowy limit, aby móc przetestować; gdy limit się wyczerpie, możesz doładować saldo ogólne w konsoli.
📘 Pełna dokumentacja: Fish Model API →
Pola ciała żądania
Pola są całkowicie zgodne z upstream, proszę również zapoznać się z oficjalną dokumentacją Fish.
Przykład: Utworzenie prywatnego klonu dźwięku
Uwaga:Odpowiedź sukcesu zwraca bezpośrednio obiekt ModelEntity platformy Fish (poniżej przykład minimalnego użytecznego dźwięku, usunięto niektóre długie pola dla lepszej czytelności):voicesmusi być ciągiem (pojedynczy URL audio), a nie tablicą. Przesłanie jako["..."]spowoduje odrzucenie przez upstream.
_id może być użyty jako wartość pola reference_id w późniejszych wywołaniach Fish TTS API do syntezowania mowy przy użyciu tego klonu dźwięku:
Wymagania dotyczące próbek
Wartości doświadczenia (zgodne z upstream, można zapoznać się z oficjalną dokumentacją Fish):- Czas trwania zalecany powyżej 30 sekund, najlepiej do 5 minut; powyżej 10 minut marginalne korzyści są niewielkie.
- Częstotliwość próbkowania 16 kHz i wyższa, mono lub stereo.
- Treść powinna być jak najczystsza: bez muzyki w tle, echa, wyraźnych hałasów otoczenia; ten sam mówca.
- Format zalecany to
mp3/wav.
enhance_audio_quality: true, aby upstream najpierw poprawił jakość dźwięku.
Informacje o opłatach
Tworzenie modelu klonu dźwięku (POST /fish/model) jest darmowe, nie pobiera się żadnych opłat; interfejsy zapytań dźwięków ([Fish Model Query](https://platform.acedata.cloud/documents/fish-model-query), [Fish Model Get](https://platform.acedata.cloud/documents/fish-model-get)) również nie są płatne. Opłaty powstają tylko podczas późniejszych wywołań Fish TTS do syntezowania mowy.
Obsługa błędów
400 token_mismatched:Brakujące lub nieprawidłowe parametry żądania (najczęściejvoicesnie jest URL, lub zostało przekazane jako tablica).401 invalid_token:Token autoryzacyjny nie istnieje lub jest nieprawidłowy.429 too_many_requests:Przekroczono limit szybkości konta.500 api_error:Błąd wewnętrzny serwera.
Wnioski
Aby wywołać to API, wystarczy przygotować publicznie dostępny URL próbki audio, umieścić go w poluvoices, aby uzyskać _id, a następnie podać go jako reference_id do /fish/tts, co zakończy proces „klonowania → syntezowania”. Częstym problemem jest to, że voices musi być ciągiem znaków, a nie tablicą.
