audio_id を使用)とは異なり、この API は公開アクセス可能な audio_url、つまりあなた自身の声の録音を受け入れます。本ドキュメントでは音声クローン API の接続方法を説明します。
第一步:音声キャラクターの作成
この API には三つの入力パラメータがあります:audio_url(必須)、これは単一の明瞭な人声を含む公開アクセス可能な MP3 または WAV 形式の音声ファイルの URL です;name と description(任意)、これは音声キャラクターの名前と説明です。
音声ファイルの要件
- 音声フォーマットは
WAVまたはMP3でなければなりません- 音声の長さは
10~240 秒の間で、30~60 秒のクリーンな単一の声の素材を推奨します- 音声には明瞭で識別可能な単一の話し声または歌声が含まれている必要があります
- バックグラウンドノイズ、伴奏、エコー、リバーブを必ず避けてください;伴奏付きの完全な曲は通常、声紋検証を通過できません
- 複数の話者や複数の声を含めないでください
- 音量が低すぎる、音声が不明瞭、ノイズが多すぎる素材は、クローン失敗や生成効果が悪い原因となる可能性があります 使用制限の説明
- アップロードされた音声を通じて作成された音声キャラクターはプライベートリソースです
- この音声キャラクターはアカウント間での再利用をサポートしていません
- 作成成功後はできるだけ早く使用することをお勧めします。長期間使用しないと無効または使用不可になる可能性があります
- 返された
nameはシステムによって自動生成されますので、返されたpersona_idを基準にしてください
呼び出し失敗時はまず再試行してください
音声クローンは計算集約型のタスクであり、素材が完全に準拠していても一定の確率で偶発的な失敗が発生します。一般的な返り値には voices_sound_different(声紋検証未通過)などがあります。この種の失敗は音声の質とは無関係で、同じ素材を使用して再試行することで通常成功します。統合時には失敗結果に対して 1~2 回の自動再試行を実装することをお勧めします。失敗したリクエストは課金されません。
上記の結果は以下の通りです:https://cdn.acedata.cloud/suno_demo.mp3は直接呼び出し可能なサンプル素材です(MP3、41 秒、単一のクリーンな声)。WAV形式のサンプルが必要な場合は、次の URL を使用できますhttps://cdn.acedata.cloud/uploads/82d23b97-ec1c-4b41-91b8-989fc51f8765(WAV、41 秒、モノラル 44.1kHz)。
data の persona_id フィールドが作成された音声キャラクターの ID です。is_public フィールドは常に false で、アップロードされた音声を通じて作成された音声キャラクターはプライベートです。返された name はシステムによって自動生成されるため、以降は persona_id を使用してこの音声キャラクターを参照してください。
第二步:音声キャラクターを使用して音楽を生成
音声キャラクター ID を取得したら、Suno Audios Generation API を使用して音楽生成を行うことができます。action を generate に設定し、persona_id を上記で返された音声キャラクター ID に設定します。生成された曲はクローンされた声で歌われます。
注意: 音声クローンはchirp-v4-5以上のモデル(例:chirp-v4-5、chirp-v5、chirp-v5-5)のみをサポートし、chirp-v4はサポートしていません。
persona_id は cover アクションと組み合わせて使用することもでき、クローンされた声で既存の曲をカバーすることができます。
