Skip to main content
SUNO tillåter oss att skapa anpassade röstkaraktärer från valfritt ljudfil, vilket möjliggör ljudkloning för musikgenerering. Till skillnad från den befintliga Persona API (som använder Suno genererat audio_id), accepterar denna API en offentligt tillgänglig audio_url, det vill säga din egen röstinspelning. Detta dokument förklarar hur man integrerar ljudkloning API.

Steg ett: Skapa röstkaraktär

Denna API har tre inparametrar: audio_url (obligatorisk), som är en offentligt tillgänglig URL för en MP3- eller WAV-format ljudfil som innehåller en tydlig röst från en person; name och description (valfria), som är namnet och beskrivningen av röstkaraktären.
Krav på ljudfil
  • Ljudformatet måste vara WAV eller MP3
  • Längden på ljudet måste vara mellan 10~240 sekunder, rekommenderas att använda 30~60 sekunder av rent solo röstmaterial
  • Ljudet bör innehålla tydlig, igenkännbar solo tal eller sång
  • Undvik bakgrundsljud, ackompanjemang, eko, reverb; kompletta låtar med ackompanjemang kan vanligtvis inte passera röstverifiering
  • Inkludera inte flera talare eller flera röster
  • Material med för låg volym, otydlig tal eller för mycket brus kan leda till kloning misslyckande eller dålig genereringseffekt Användningsbegränsningar
  • Röstkaraktärer skapade genom att ladda upp ljud är privata resurser
  • Denna röstkaraktär stöder inte återanvändning mellan konton
  • Det rekommenderas att använda den så snart som möjligt efter skapandet, långvarig inaktivitet kan leda till utgång eller otillgänglighet
  • Det returnerade name genereras automatiskt av systemet, vänligen använd det returnerade persona_id som referens för denna röstkaraktär
Vid misslyckande, försök igen Ljudkloning är en resurskrävande uppgift, även om materialet är helt i enlighet med kraven finns det en viss sannolikhet för sporadiska misslyckanden, vanliga svar som voices_sound_different (röstverifiering misslyckades) etc. Dessa misslyckanden har inget att göra med ljudkvaliteten, att försöka igen med samma material lyckas vanligtvis, det rekommenderas att implementera 1-2 automatiska försök vid integration. Misslyckade förfrågningar debiteras inte.
Den ovanstående https://cdn.acedata.cloud/suno_demo.mp3 är ett direkt anropbart exempelmaterial (MP3, 41 sekunder, solo röst). För ett exempel i WAV format, kan du använda https://cdn.acedata.cloud/uploads/82d23b97-ec1c-4b41-91b8-989fc51f8765 (WAV, 41 sekunder, mono 44.1kHz).
Resultatet ser ut så här:
Som du kan se, data fältet persona_id är ID för den skapade röstkaraktären. is_public fältet är alltid false, eftersom röstkaraktärer skapade genom att ladda upp ljud är privata. Observera att det returnerade name är automatiskt genererat av systemet, vänligen använd persona_id för att referera till denna röstkaraktär.

Steg två: Använd röstkaraktär för att generera musik

När vi har röstkaraktärens ID kan vi använda Suno Audios Generation API för att generera musik. Sätt action till generate, och sätt persona_id till det ovan returnerade röstkaraktärens ID, den genererade låten kommer att sjungas med den klonade rösten.
Observera: Ljudkloning stöder endast modeller chirp-v4-5 och högre (som chirp-v4-5, chirp-v5, chirp-v5-5), stöder inte chirp-v4.
Resultatet ser ut så här:
Som du kan se, den genererade låten sjöngs med den klonade rösten. persona_id kan också användas tillsammans med cover åtgärden för att göra en cover av en befintlig låt med den klonade rösten.