Skip to main content
SUNO consente di creare ruoli vocali personalizzati tramite qualsiasi file audio, realizzando il cloning della voce per la generazione musicale. A differenza dell’API Persona esistente (che utilizza audio_id generato da Suno), questa API accetta un audio_url accessibile pubblicamente, ovvero la registrazione vocale di una persona. Questo documento spiega come integrare l’API di cloning della voce.

Primo passo: Creare un ruolo vocale

Questa API ha tre parametri di input: audio_url (obbligatorio), che deve essere un URL di un file audio in formato MP3 o WAV accessibile pubblicamente, contenente una voce umana chiara; name e description (opzionali), che sono il nome e la descrizione del ruolo vocale.
Requisiti per il file audio
  • Il formato audio deve essere WAV o MP3
  • La durata audio deve essere compresa tra 10~240 secondi, si consiglia di utilizzare materiale vocale pulito di 30~60 secondi
  • L’audio deve contenere voce chiara e riconoscibile di una sola persona
  • Evitare assolutamente rumori di fondo, accompagnamenti, echi, riverberi; canzoni complete con accompagnamento di solito non superano la verifica della voce
  • Non includere più di un parlante o voci multiple
  • Materiale con volume troppo basso, voce poco chiara o rumori eccessivi potrebbe causare fallimento del cloning o risultati scadenti Limitazioni d’uso
  • I ruoli vocali creati tramite l’upload audio sono risorse private
  • Questo ruolo vocale non supporta il riutilizzo tra account
  • Si consiglia di utilizzarlo il prima possibile dopo la creazione, un lungo periodo di inattività potrebbe causare scadenza o non disponibilità
  • Il name restituito è generato automaticamente dal sistema, fare riferimento al persona_id restituito
In caso di fallimento della chiamata, riprovare Il cloning della voce è un compito intensivo in termini di calcolo, anche se il materiale è completamente conforme, esiste una certa probabilità di fallimento occasionale, come il comune ritorno voices_sound_different (verifica della voce non superata). Questi fallimenti non sono correlati alla qualità audio, riprovare con lo stesso materiale di solito porta al successo, si consiglia di implementare 1-2 tentativi automatici in caso di risultati di fallimento. Le richieste fallite non verranno addebitate.
L’URL https://cdn.acedata.cloud/suno_demo.mp3 è un materiale di esempio direttamente utilizzabile (MP3, 41 secondi, voce pulita di una sola persona). Per un esempio in formato WAV, è possibile utilizzare https://cdn.acedata.cloud/uploads/82d23b97-ec1c-4b41-91b8-989fc51f8765 (WAV, 41 secondi, mono 44.1kHz).
Il risultato è il seguente:
Si può notare che il campo persona_id di data è l’ID del ruolo vocale creato. Il campo is_public è sempre false, poiché i ruoli vocali creati tramite l’upload audio sono privati. Si prega di notare che il name restituito è generato automaticamente dal sistema, utilizzare successivamente il persona_id per fare riferimento a questo ruolo vocale.

Secondo passo: Utilizzare il ruolo vocale per generare musica

Una volta ottenuto l’ID del ruolo vocale, possiamo utilizzare l’API di Generazione Audio di Suno per generare musica. Impostare action su generate e persona_id sull’ID del ruolo vocale restituito sopra, la canzone generata utilizzerà la voce clonata per il canto.
Nota: Il cloning della voce supporta solo modelli chirp-v4-5 e superiori (come chirp-v4-5, chirp-v5, chirp-v5-5), non supporta chirp-v4.
Il risultato è il seguente:
Si può notare che la canzone generata utilizza la voce clonata per il canto. Il persona_id può anche essere utilizzato con l’azione cover per reinterpretare canzoni esistenti con la voce clonata.