Skip to main content
SUNO ci consente di creare ruoli vocali personalizzati tramite qualsiasi file audio, realizzando la clonazione della voce per la generazione musicale. A differenza dell’API Persona esistente (che utilizza audio_id generato da Suno), questa API accetta un audio_url accessibile pubblicamente, ovvero la registrazione della tua voce. Questo documento spiega come integrare l’API di clonazione vocale.

Primo passo: Creare un ruolo vocale

Questa API ha tre parametri di input: audio_url (obbligatorio), che deve essere un URL di un file audio in formato MP3 o WAV accessibile pubblicamente, contenente una voce umana chiara e singola; name e description (opzionali), che sono il nome e la descrizione del ruolo vocale.
Requisiti per il file audio
  • Il formato audio deve essere WAV o MP3
  • La durata audio deve essere compresa tra 10 e 240 secondi, si consiglia di utilizzare materiale di voce singola pulita di 30-60 secondi
  • L’audio deve contenere voce chiara e riconoscibile di una persona che parla o canta
  • Si prega di evitare rumori di fondo, accompagnamenti, echi, riverberi; le canzoni complete con accompagnamento di solito non superano la verifica della voce
  • Non includere più parlanti o voci multiple
  • Materiale con volume troppo basso, voce poco chiara o rumore eccessivo potrebbe causare fallimenti nella clonazione o risultati di bassa qualità Limitazioni d’uso
  • I ruoli vocali creati tramite l’upload audio sono risorse private
  • Questo ruolo vocale non supporta il riutilizzo tra account
  • Si consiglia di utilizzarlo il prima possibile dopo la creazione, un lungo periodo di inattività potrebbe causare scadenza o non disponibilità
  • Il name restituito è generato automaticamente dal sistema, fare riferimento al persona_id restituito
In caso di fallimento della chiamata, si prega di riprovare La clonazione vocale è un compito intensivo in termini di calcolo, anche se il materiale è completamente conforme, esiste una certa probabilità di fallimenti occasionali, come il ritorno di voices_sound_different (verifica della voce non superata). Questi fallimenti non sono correlati alla qualità audio, riprovare con lo stesso materiale di solito porta al successo, si consiglia di implementare 1-2 tentativi automatici in caso di risultati di fallimento. Le richieste fallite non verranno addebitate.
L’URL https://cdn.acedata.cloud/suno_demo.mp3 è un materiale di esempio direttamente utilizzabile (MP3, 41 secondi, voce singola pulita). Se hai bisogno di un esempio in formato WAV, puoi utilizzare https://cdn.acedata.cloud/uploads/82d23b97-ec1c-4b41-91b8-989fc51f8765 (WAV, 41 secondi, mono 44.1kHz).
Il risultato è il seguente:
Come puoi vedere, il campo persona_id di data è l’ID del ruolo vocale creato. Il campo is_public è sempre false, poiché i ruoli vocali creati tramite l’upload audio sono privati. Nota che il name restituito è generato automaticamente dal sistema, in seguito utilizza il persona_id per fare riferimento a quel ruolo vocale.

Secondo passo: Utilizzare il ruolo vocale per generare musica

Una volta ottenuto l’ID del ruolo vocale, possiamo utilizzare l’API di generazione audio Suno per generare musica. Imposta action su generate e persona_id sull’ID del ruolo vocale restituito sopra, la canzone generata utilizzerà la voce clonata per cantare.
Nota: La clonazione vocale supporta solo modelli chirp-v4-5 e superiori (come chirp-v4-5, chirp-v5, chirp-v5-5), non supporta chirp-v4.
Il risultato è il seguente:
Come puoi vedere, la canzone generata utilizza la voce clonata per cantare. Il persona_id può anche essere utilizzato con l’azione cover per reinterpretare canzoni esistenti con la voce clonata.