Skip to main content
本接口基於 Fish Audio 官方 Model API,用於基於一段音頻樣本創建一個可長期復用的克隆聲音模型。地址為 POST https://api.acedata.cloud/fish/model
只需臨時使用參考聲音時,無需創建模型,可直接使用 Fish TTS APIreferences 一次性即時克隆。分頁檢索現有音色請參考 Fish Model Query API;按 _id 查詢單個音色詳情請參考 Fish Model Get API

申請流程

要使用 Fish Model API,首先到 Ace Data Cloud 控制台 獲取您的 API Token,留作備用。 如果你尚未登錄或註冊,會自動跳轉到登錄頁面邀請你註冊和登錄,完成後會自動返回當前頁面。 一個 API Token 即可調用平台所有服務,無需為每個服務單獨申請。 首次申請會贈送免費額度,可免費體驗;額度不足時可在 控制台 充值通用餘額。
📘 完整文檔:Fish Model API →

請求體字段

字段與上游完全一致,請同時參考 Fish 官方文檔

示例:創建一個私有克隆音色

注意:voices 必須是字符串(單個音頻 URL),不是數組。傳成 ["..."] 上游會拒絕。
成功響應直接返回 Fish 平台的 ModelEntity 對象(下例為我們實測過的最小可用音色,刪去了部分長字段以便閱讀):
_id 即可作為後續 Fish TTS APIreference_id 字段的值,用於使用該克隆音色進行語音合成:

樣本要求

經驗值(與上游一致,可參考 Fish 官方文檔):
  • 時長建議 30 秒以上,5 分鐘以內效果最佳;超過 10 分鐘邊際收益不大。
  • 采樣率 16 kHz 及以上,單聲道或立體聲均可。
  • 內容儘量乾淨:無背景音樂、回聲、明顯環境噪聲;同一說話人。
  • 格式建議 mp3 / wav
如果對樣本質量沒有把握,可以同時傳 enhance_audio_quality: true 讓上游先做音質增強。

計費說明

創建音色克隆模型(POST /fish/model)免費,不收取任何費用;音色的查詢接口(Fish Model QueryFish Model Get)同樣不計費。費用僅在後續調用 Fish TTS 合成語音時按用量產生。

錯誤處理

  • 400 token_mismatched:請求參數缺失或不合法(最常見是 voices 不是 URL,或傳成了數組)。
  • 401 invalid_token:鑑權 token 不存在或無效。
  • 429 too_many_requests:觸發帳號速率限制。
  • 500 api_error:伺服器內部錯誤。
錯誤響應示例:

結論

調用本接口只需要準備一段可公開訪問的樣本音頻 URL,把它放到 voices 欄位即可拿到 _id,再餵給 /fish/ttsreference_id 就完成了端到端的「克隆 → 合成」。常見坑點是 voices 必須是字符串、不能是數組。