audio_id), accepterar denna API en offentligt tillgänglig audio_url, det vill säga din egen röstinspelning. Detta dokument förklarar hur man integrerar ljudkloning API.
Steg ett: Skapa röstkaraktär
Denna API har tre inparametrar:audio_url (obligatorisk), som är en offentligt tillgänglig URL för en MP3- eller WAV-format ljudfil som innehåller en tydlig röst från en person; name och description (valfria), som är namnet och beskrivningen av röstkaraktären.
Krav på ljudfil
- Ljudformatet måste vara
WAVellerMP3- Längden på ljudet måste vara mellan
10~240 sekunder, rekommenderas att använda30~60 sekunderav rent solo röstmaterial- Ljudet bör innehålla tydlig, igenkännbar solo tal eller sång
- Undvik bakgrundsljud, ackompanjemang, eko, reverb; kompletta låtar med ackompanjemang kan vanligtvis inte passera röstverifiering
- Inkludera inte flera talare eller flera röster
- Material med för låg volym, otydlig tal eller för mycket brus kan leda till kloning misslyckande eller dålig genereringseffekt Användningsbegränsningar
- Röstkaraktärer skapade genom att ladda upp ljud är privata resurser
- Denna röstkaraktär stöder inte återanvändning mellan konton
- Det rekommenderas att använda den så snart som möjligt efter skapandet, långvarig inaktivitet kan leda till utgång eller otillgänglighet
- Det returnerade
namegenereras automatiskt av systemet, vänligen använd det returneradepersona_idsom referens för denna röstkaraktär
Vid misslyckande, försök igen
Ljudkloning är en resurskrävande uppgift, även om materialet är helt i enlighet med kraven finns det en viss sannolikhet för sporadiska misslyckanden, vanliga svar som
voices_sound_different (röstverifiering misslyckades) etc. Dessa misslyckanden har inget att göra med ljudkvaliteten, att försöka igen med samma material lyckas vanligtvis,
det rekommenderas att implementera 1-2 automatiska försök vid integration. Misslyckade förfrågningar debiteras inte.
Den ovanståendeResultatet ser ut så här:https://cdn.acedata.cloud/suno_demo.mp3är ett direkt anropbart exempelmaterial (MP3, 41 sekunder, solo röst). För ett exempel iWAVformat, kan du användahttps://cdn.acedata.cloud/uploads/82d23b97-ec1c-4b41-91b8-989fc51f8765(WAV, 41 sekunder, mono 44.1kHz).
data fältet persona_id är ID för den skapade röstkaraktären. is_public fältet är alltid false, eftersom röstkaraktärer skapade genom att ladda upp ljud är privata. Observera att det returnerade name är automatiskt genererat av systemet, vänligen använd persona_id för att referera till denna röstkaraktär.
Steg två: Använd röstkaraktär för att generera musik
När vi har röstkaraktärens ID kan vi använda Suno Audios Generation API för att generera musik. Sättaction till generate, och sätt persona_id till det ovan returnerade röstkaraktärens ID, den genererade låten kommer att sjungas med den klonade rösten.
Observera: Ljudkloning stöder endast modellerchirp-v4-5och högre (somchirp-v4-5,chirp-v5,chirp-v5-5), stöder intechirp-v4.
persona_id kan också användas tillsammans med cover åtgärden för att göra en cover av en befintlig låt med den klonade rösten.
