audio_id généré par Suno), cette API accepte une audio_url accessible publiquement, c’est-à-dire votre propre enregistrement vocal. Ce document explique comment intégrer l’API de clonage de voix.
Étape 1 : Créer un personnage vocal
Cette API a trois paramètres d’entrée :audio_url (obligatoire), qui est une URL d’un fichier audio au format MP3 ou WAV accessible publiquement, contenant une voix humaine claire d’une seule personne ; name et description (facultatifs), qui sont le nom et la description du personnage vocal.
Exigences pour le fichier audio
- Le format audio doit être
WAVouMP3- La durée audio doit être comprise entre
10 et 240 secondes, il est recommandé d’utiliser un matériau vocal clair d’une seule personne de30 à 60 secondes- L’audio doit contenir une voix humaine claire et identifiable d’une seule personne parlant ou chantant
- Veuillez éviter le bruit de fond, les accompagnements, les échos, la réverbération ; les chansons complètes avec accompagnement ne peuvent généralement pas passer la vérification de la voix
- Ne pas inclure plusieurs locuteurs ou plusieurs voix
- Les matériaux avec un volume trop bas, une voix peu claire ou un bruit excessif peuvent entraîner un échec du clonage ou un résultat de génération de mauvaise qualité Restrictions d’utilisation
- Les personnages vocaux créés par le téléchargement d’audio sont des ressources privées
- Ce personnage vocal ne prend pas en charge la réutilisation entre comptes
- Il est conseillé de l’utiliser rapidement après sa création, une longue période sans utilisation peut entraîner une expiration ou une indisponibilité
- Le
nameretourné est généré automatiquement par le système, veuillez vous référer aupersona_idretourné
En cas d’échec de l’appel, veuillez d’abord réessayer
Le clonage de voix est une tâche gourmande en ressources, même si le matériau est entièrement conforme, il existe une certaine probabilité d’échec sporadique, des retours courants comme voices_sound_different (vérification de la voix non réussie) peuvent survenir. Ces échecs ne sont pas liés à la qualité audio, réessayer avec le même matériau réussit généralement,
il est conseillé d’implémenter 1 à 2 tentatives automatiques en cas de résultats d’échec lors de l’intégration. Les demandes échouées ne seront pas facturées.
L’URLLe résultat est le suivant :https://cdn.acedata.cloud/suno_demo.mp3est un matériau d’exemple directement appelable (MP3, 41 secondes, voix humaine claire). Pour un exemple au formatWAV, vous pouvez utiliserhttps://cdn.acedata.cloud/uploads/82d23b97-ec1c-4b41-91b8-989fc51f8765(WAV, 41 secondes, mono 44.1kHz).
persona_id dans data est l’ID du personnage vocal créé. Le champ is_public est toujours false, car les personnages vocaux créés par le téléchargement d’audio sont privés. Notez que le name retourné est généré automatiquement par le système, veuillez utiliser le persona_id pour référencer ce personnage vocal par la suite.
Étape 2 : Utiliser le personnage vocal pour générer de la musique
Une fois que nous avons l’ID du personnage vocal, nous pouvons utiliser l’API de génération de musique Suno pour générer de la musique. Définissezaction sur generate et persona_id sur l’ID du personnage vocal retourné ci-dessus, la chanson générée sera chantée avec la voix clonée.
Remarque : Le clonage de voix ne prend en charge que les modèleschirp-v4-5et supérieurs (commechirp-v4-5,chirp-v5,chirp-v5-5), ne prend pas en chargechirp-v4.
persona_id peut également être utilisé avec l’action cover pour reprendre des chansons existantes avec la voix clonée.
