Skip to main content
Detta gränssnitt erbjuder text-till-tal, anrop av sparade röster och engångs omedelbar ljudkloning, adressen är POST https://api.acedata.cloud/fish/tts

Ansökningsprocess

För att använda Fish TTS API, börja med att gå till Ace Data Cloud-konsolen för att få din API-token, som du ska spara. Om du inte har loggat in eller registrerat dig, kommer du automatiskt att omdirigeras till inloggningssidan för att registrera dig och logga in, och efter att ha slutfört detta kommer du automatiskt att återvända till den aktuella sidan. En API-token kan användas för att anropa alla tjänster på plattformen, det behövs ingen separat ansökan för varje tjänst. Första ansökan ger en gratis kvot för att prova; om kvoten är otillräcklig kan du ladda på allmän balans i konsolen.
📘 Fullständig dokumentation: Fish TTS API →

Begärningshuvud

Begärningskroppsfält

Engångs kloning accepterar endast HTTPS ljud-URL, accepterar inte MessagePack, Base64, data URI eller URL med autentisering. Referensljud rekommenderas att vara 10–270 sekunder; Studio använder en mer konservativ 10–60 sekunders intervall.

Exempel 1: Minsta begäran(text + format=mp3

Svar (testat):
audio_url pekar på plattformens CDN, kan direkt GET-ladda ner eller spelas i <audio>-taggen. Det slutliga framgångsrika svaret kommer också att returnera den övergripande cost, där amount är de Credits som faktiskt dragits denna gång; om det finns kontorabatt, representerar list_amount beloppet före rabatten. Länken är långvarig, men det rekommenderas fortfarande att spara en kopia i din egen lagring.

Exempel 2: Använd klonröst reference_id

Nedan används en offentlig spansktalande röst på Fish-plattformen(_id kan hämtas via Fish Model Query):
Svar (testat):

Exempel 3: Engångs omedelbar ljudkloning(references

Placera referensljudet på en offentlig HTTPS-adress och ge den exakta transkriptionen av vad som faktiskt sagts. Denna röst används endast för denna syntes och kommer inte att skapa en långvarig modell:
Testat framgångsrikt svar:

Exempel 3: Justera talhastighet / volym (prosody)

Svar (verkligen testat):
speed större än 1 ökar hastigheten, mindre än 1 sänker hastigheten; volume enhet dB, 0 betyder oförändrad, positiva värden ökar, negativa värden minskar.

Exempel 5: Byt modell + kontrollera bitrate

Genom HTTP-huvudet model: s1 byter du till stabil modell, lägg till mp3_bitrate: 128 i begäran för att kontrollera MP3-bitraten:
Svar (verkligen testat):

Exempel 6: PCM råvågform

Behöver du göra realtidskoppling i webbläsaren, eller göra efterbehandling (mixning, hastighetsändring) på klienten, rekommenderas att använda pcm:
Svar (verkligen testat):
Länkens filändelse följer begäran i format: mp3 ger .mp3, wav och pcm ger .wav (WAV-container, 16 bit PCM).

Asynkron återkoppling (callback_url)

Långa texter kan ta flera sekunder till flera minuter att syntetisera, om anslutningen bryts behöver du försöka igen. När du skickar callback_url i begäran kommer gränssnittet omedelbart att returnera {task_id, started_at}, när den verkliga uppgiften är klar kommer den kompletta resultatet att POST:as i JSON-format till den URL:en, med samma task_id och den slutgiltiga kostnaden för denna begäran. Den initiala uppgiften bekräftar att syntesen ännu inte är klar, så den innehåller inte cost.
Omedelbart svar (verkligen testat):
Lite senare kommer callback_url att få något som:
Du kan också använda Fish Tasks API för att aktivt hämta resultatet med task_id; den slutgiltiga posten av response.cost är densamma som kostnaden i återkopplingen, se den dokumentationen för mer information.

Felhantering

  • 400 token_mismatched: Begäran saknar parametrar eller är ogiltig (vanligast är att text är tom, eller att format har ett värde utöver mp3/wav/pcm).
  • 401 invalid_token: Autentiseringstoken finns inte eller är ogiltig.
  • 429 too_many_requests: Utnyttjar kontots hastighetsbegränsning.
  • 500 api_error: Intern serverfel.
Exempel på felrespons:
Parameterkontrollfel kommer att förklaras i message-fältet med ogiltiga fält, till exempel:

Slutsats

Den minimi kostnaden för att integrera Fish TTS är: att i befintlig kod som anropar api.fish.audio/v1/tts byta autentisering till plattformens token och i begäran uttryckligen inkludera format: "mp3". För långa texter rekommenderas att använda callback_url för asynkron återkoppling; för att upptäcka klonade röster reference_id, vänligen kombinera med Fish Model Query och Fish Model Get.