content 結構建立任務。
申請流程
要使用 MiniMax H3 影片生成 API,首先到 Ace Data Cloud 控制台 取得您的 API Token,留作備用。
如果你尚未登入或註冊,會自動跳轉到登入頁面邀請你註冊和登入,完成後會自動返回目前頁面。
一個 API Token 即可呼叫平台所有服務,無需為每個服務個別申請。 首次申請會贈送免費額度,可免費體驗;額度不足時可在 控制台 儲值通用餘額。
📘 完整文件:MiniMax H3 影片生成 API →建議把 Token 儲存為環境變數,不要寫入原始碼或提交到版本庫:
介面概覽
- Base URL:
https://api.acedata.cloud - Endpoint:
POST /minimax/videos - 驗證方式:HTTP Header 中攜帶
authorization: Bearer {token} - 請求標頭:
accept: application/jsoncontent-type: application/json
- 模型(model):
MiniMax-H3 - 輸入結構:透過
content統一傳入文字、圖片、影片和音訊 - 輸出模式:預設同步等待生成完成並返回完整
task;傳入async: true或callback_url時立即返回task_id與trace_id - 結果查詢:透過 MiniMax H3 任務查詢 API 取得狀態和成片
- 非同步回呼:可選,透過
callback_url接收最終任務結果
action 來選擇生成模式,介面會根據 content 中的素材類型和 role 自動判斷用途。
適合哪些情境
呼叫流程
預設不傳入async 時,/minimax/videos 會等待生成完成並直接返回完整 task。需要立即釋放連線時,傳入 async: true 或 callback_url:
- 儲存立即回應中的
task_id和trace_id。 - 未設定回呼時,每隔約 10 秒呼叫
/minimax/tasks查詢一次。 - 當
task.status變為succeeded時,從task.content.url取得影片。 - 當狀態為
failed或cancelled時停止輪詢,並讀取task.error。
頂層請求參數
ratio 的規則取決於工作流程:
- 文字生成影片:必填,且不能為
adaptive。 - 首幀、尾幀或首尾幀影片:畫幅由輸入圖片決定,建議省略或傳入
adaptive。 - 多模態參考生成影片:可省略,預設為
adaptive;也可以明確指定一個固定比例。
prompt、image_urls、audio_urls、messages 和 first_frame_image。收到這類參數錯誤時,請刪除舊欄位並遷移至 content;例如把 "prompt": "一隻貓揮手" 改為 "content": [{"type": "text", "text": "一隻貓揮手"}]。不要同時傳送新舊兩種格式。
content 內容項目參數
每個內容項目都必須有type,其餘欄位由類型決定:
媒體位址支援三種形式:
- 可公開存取的 HTTPS URL,建議用於大型檔案。
mm_file://{file_id},引用已上傳或已有結果的檔案。- 對應媒體類型的 Base64 data URI。Base64 會使體積增加約三分之一,請確保整個請求本體不超過 64 MB。
素材規格與數量限制
多模態參考場景中的圖片、影片和音訊合計最多 12 個檔案。首尾幀場景和參考素材場景互斥:一旦使用
reference_image、reference_video 或 reference_audio,就不能再使用 first_frame 或 last_frame,反之亦然。
生產級能力展示
下面不是概念圖或佔位素材,而是 MiniMax H3 官方生產級能力樣片的真實參考輸入與實際影片輸出。三組案例分別涵蓋品牌短片、真人敘事和時尚電商,適合評估模型在商業製作中最關鍵的能力。
這裡的「人臉能力」指影片生成中的人物外觀一致性、臉部細節和表演控制,不是身分識別、人臉比對或換臉介面。
高端品牌短片:人物、產品與品牌資產統一
製作目標: 16:9 高級時裝品牌片。以荒漠公路和復古汽車建立冷峻氛圍,保持女主角外觀與黑色手袋結構,並將品牌 Logo 自然納入結尾。這個案例重點檢驗跨鏡頭人物一致性、商品保持、電影質感和品牌收束能力。
直接開啟或下載品牌短片
對應的
content 組織方式:
真人直式短劇:人臉一致性與情緒表演
製作目標: 15 秒、9:16 暗黑浪漫短劇預告。透過男女主角參考圖鎖定人物外觀,以古堡參考圖約束空間;使用中近景與面部特寫表現眼神對峙、恐懼、克制和危險感。這個案例適合觀察真人五官穩定性、微表情、視線關係和連續表演。
直接開啟或下載真人短劇
提示詞應明確人物關係、情緒和景別,而不只是描述「男女對話」:
時尚眼鏡廣告:人臉細節與商品結構保持
製作目標: 9:16 高級時尚眼鏡廣告。人物全身圖負責身形與台步,人臉參考圖負責五官和妝容,產品圖負責環繞曲線、鏡片反射、鏡腳和貓眼輪廓。這個案例同時考驗臉部近景、多人一致性、佩戴關係和商品幾何結構。
直接開啟或下載時尚眼鏡廣告
在商品廣告中,提示詞應把人物參考和產品參考的職責分開寫清楚:人物素材約束臉、妝容、身形和氣質;產品素材約束輪廓、材質、反射和佩戴位置。這樣比籠統地寫「生成一支眼鏡廣告」更穩定。
文生影片
只有一個文字項時即為文生影片。適合從創意、腳本或鏡頭描述直接生成畫面。提示詞可以按「主體 + 動作 + 場景 + 鏡頭 + 光線 + 聲音」的順序組織。"async": true,介面立即傳回:
首幀圖生影片
將圖片標記為first_frame,模型會從該畫面開始生成。適合讓海報、商品圖、角色設定圖和攝影作品自然動起來。
尾幀和首尾幀影片
僅提供last_frame 可以讓模型自然生成至指定畫面;同時提供 first_frame 與 last_frame,可以明確控制起點和終點。適合轉場、形態變化、成長過程或產品前後對比。
多模態參考生影片
參考素材可以組合使用:參考圖片控制角色或產品外觀,參考影片控制動作和運鏡,參考音訊控制對白音色、音樂或剪輯節奏。提示詞中應明確說明每類素材要控制什麼,避免只上傳素材卻不給出關聯關係。回呼通知
傳入callback_url 會自動啟用非同步模式:建立介面立即返回 task_id 和 trace_id,並在任務完成後向該地址 POST 最終結果,結構與任務查詢回應一致。
回呼中的最終狀態為 succeeded、failed 或 cancelled。即使使用回呼,也建議儲存 task_id,以便主動查詢或補償遺漏的通知。
常見錯誤
同步回應中的
task.status: succeeded 表示影片已生成;非同步確認只代表任務已進入佇列。只有任務最終成功時才會計費,查詢任務本身免費,不會重複扣費。
H3 Max
MiniMax-H3-Max 支援 480P 或 768P、5–15 秒整數時長。音訊輸入不額外計費,前 2 張圖片免費,超出部分逐張計費;參考影片按實際輸入時長計費。該模型不支援 2K。
