Skip to main content
Detta gränssnitt är baserat på Fish Audio officiella Model API och används för att skapa en klon av ljudmodell som kan återanvändas långsiktigt baserat på ett ljudprov. Adressen är POST https://api.acedata.cloud/fish/model.
Om du bara tillfälligt behöver använda referensljud, behöver du inte skapa en modell, utan kan direkt använda Fish TTS API references för engångskloning. För att paginera och hämta befintliga ljudfärger, se Fish Model Query API; för att söka detaljer om enskilda ljudfärger baserat på _id, se Fish Model Get API.

Ansökningsprocess

För att använda Fish Model API, börja med att gå till Ace Data Cloud-konsolen för att få din API-token, som du ska spara. Om du inte har loggat in eller registrerat dig, kommer du automatiskt att omdirigeras till inloggningssidan för att registrera dig och logga in, och efter att du har slutfört detta kommer du automatiskt att återvända till den aktuella sidan. En API-token räcker för att anropa alla plattformens tjänster, du behöver inte ansöka separat för varje tjänst. Första ansökan ger en gratis kvot för att prova; när kvoten är slut kan du ladda på allmän balans i konsolen.
📘 Fullständig dokumentation: Fish Model API →

Begärningskroppsfält

Fälten är helt identiska med upstream, vänligen se även Fish officiella dokumentation.

Exempel: Skapa en privat klonljudfärg

Observera: voices måste vara en sträng (en enda ljud-URL), inte en array. Om det skickas som ["..."] kommer upstream att avvisa det.
Ett framgångsrikt svar returnerar direkt Fish-plattformens ModelEntity-objekt (nedan är vårt testade minimi-användbara ljudfärg, vissa långa fält har tagits bort för läsbarhet):
_id kan användas som värdet för reference_id-fältet i efterföljande Fish TTS API för att använda den klonade ljudfärgen för talgenerering:

Provkrav

Erfarenhetsvärden (enligt upstream, se Fish officiella dokumentation):
  • Längden bör vara över 30 sekunder och under 5 minuter för bästa resultat; över 10 minuter ger inte mycket mer värde.
  • Samplingsfrekvens 16 kHz eller högre, mono eller stereo är okej.
  • Innehållet bör vara så rent som möjligt: ingen bakgrundsmusik, ekon, uppenbart miljöljud; samma talare.
  • Format rekommenderas mp3 / wav.
Om du är osäker på provkvaliteten kan du samtidigt skicka enhance_audio_quality: true för att låta upstream först förbättra ljudkvaliteten.

Avgiftsinformation

Att skapa en klonljudmodell (POST /fish/model) är gratis och kostar inget; ljudfärgens sökgränssnitt (Fish Model Query, Fish Model Get) debiteras inte heller. Avgifter uppstår endast vid efterföljande anrop av Fish TTS för talgenerering.

Felhantering

  • 400 token_mismatched:Begärningsparametrar saknas eller är ogiltiga (det vanligaste är att voices inte är en URL, eller att det har skickats som en array).
  • 401 invalid_token:Autentiseringstoken finns inte eller är ogiltig.
  • 429 too_many_requests:Uppnått konto hastighetsbegränsning.
  • 500 api_error:Intern serverfel.
Exempel på felrespons:

Slutsats

För att anropa detta gränssnitt behöver du bara förbereda en offentligt tillgänglig provljud-URL, sätta den i voices-fältet för att få _id, och sedan ge den till /fish/tts som reference_id för att slutföra end-to-end “kloning → syntes”. Vanliga fallgropar är att voices måste vara en sträng, inte en array.