content 구조를 사용하여 작업을 생성합니다.
신청 절차
MiniMax H3 비디오 생성 API를 사용하려면 먼저 Ace Data Cloud 콘솔에서 API Token을 발급받아 보관해 두세요.
아직 로그인하거나 가입하지 않은 경우, 로그인 페이지로 자동 이동하여 가입 및 로그인을 안내하며, 완료 후 현재 페이지로 자동 돌아옵니다.
하나의 API Token으로 플랫폼의 모든 서비스를 호출할 수 있으며, 서비스별로 별도 신청할 필요가 없습니다. 최초 신청 시 무료 크레딧이 제공되어 무료로 체험할 수 있으며, 크레딧이 부족할 경우 콘솔에서 공용 잔액을 충전할 수 있습니다.
📘 전체 문서: MiniMax H3 비디오 생성 API →Token은 환경 변수로 저장하고, 소스 코드에 작성하거나 버전 저장소에 커밋하지 않는 것을 권장합니다:
인터페이스 개요
- Base URL:
https://api.acedata.cloud - Endpoint:
POST /minimax/videos - 인증 방식:HTTP Header에
authorization: Bearer {token}포함 - 요청 헤더:
accept: application/jsoncontent-type: application/json
- 모델(model):
MiniMax-H3 - 입력 구조:
content를 통해 텍스트, 이미지, 비디오 및 오디오를 통합 전달 - 출력 모드:기본적으로 생성 완료까지 동기 대기하고 전체
task를 반환합니다.async: true또는callback_url을 전달하면 즉시task_id와trace_id를 반환합니다. - 결과 조회:MiniMax H3 작업 조회 API를 통해 상태와 완성 영상을 가져옵니다.
- 비동기 콜백:선택 사항이며,
callback_url을 통해 최종 작업 결과를 수신합니다.
action을 전달할 필요가 없으며, 인터페이스가 content 내 소재의 유형과 role에 따라 용도를 자동으로 판단합니다.
적합한 시나리오
호출 절차
기본적으로async를 전달하지 않으면 /minimax/videos는 생성 완료까지 대기한 후 전체 task를 직접 반환합니다. 즉시 연결을 해제해야 하는 경우 async: true 또는 callback_url을 전달하세요:
- 즉시 응답의
task_id와trace_id를 저장합니다. - 콜백을 구성하지 않은 경우 약 10초마다
/minimax/tasks를 호출하여 한 번씩 조회합니다. task.status가succeeded로 변경되면task.content.url에서 비디오를 가져옵니다.- 상태가
failed또는cancelled이면 폴링을 중지하고task.error를 읽습니다.
최상위 요청 파라미터
ratio의 규칙은 워크플로에 따라 다릅니다:
- 텍스트-비디오 생성:필수이며,
adaptive일 수 없습니다. - 첫 프레임, 마지막 프레임 또는 첫·마지막 프레임 비디오:화면 비율은 입력 이미지에 의해 결정되며, 생략하거나
adaptive를 전달하는 것을 권장합니다. - 멀티모달 참조 비디오 생성:생략할 수 있으며, 기본값은
adaptive입니다. 고정 비율을 명시적으로 지정할 수도 있습니다.
prompt, image_urls, audio_urls, messages, first_frame_image와 같은 구버전 또는 호환 필드를 허용하지 않습니다. 이러한 파라미터 오류를 받으면 구 필드를 삭제하고 content로 마이그레이션하세요. 예를 들어 "prompt": "고양이가 손을 흔든다"를 "content": [{"type": "text", "text": "고양이가 손을 흔든다"}]로 변경합니다. 새 형식과 구 형식을 동시에 전송하지 마세요.
content 콘텐츠 항목 파라미터
각 콘텐츠 항목에는 반드시type이 있어야 하며, 나머지 필드는 유형에 따라 결정됩니다:
미디어 주소는 세 가지 형식을 지원합니다:
- 공개적으로 접근 가능한 HTTPS URL이며, 대용량 파일에 권장됩니다.
mm_file://{file_id}이며, 이미 업로드했거나 기존 결과의 파일을 참조합니다.- 해당 미디어 유형의 Base64 data URI입니다. Base64는 용량을 약 3분의 1 증가시키므로 전체 요청 본문이 64 MB를 초과하지 않도록 하세요.
소재 사양 및 수량 제한
멀티모달 참고 시나리오의 이미지, 비디오 및 오디오는 합계 최대 12개 파일입니다. 첫·마지막 프레임 시나리오와 참고 소재 시나리오는 상호 배타적입니다.
reference_image, reference_video 또는 reference_audio를 사용하면 first_frame 또는 last_frame을 더 이상 사용할 수 없으며, 그 반대도 마찬가지입니다.
프로덕션급 역량 시연
아래는 콘셉트 이미지나 자리표시자 소재가 아니라 MiniMax H3 공식 프로덕션급 역량 샘플의 실제 참고 입력과 실제 비디오 출력입니다. 세 가지 사례는 각각 브랜드 단편, 실사 내러티브 및 패션 이커머스를 다루며, 상업 제작에서 가장 중요한 모델 역량을 평가하는 데 적합합니다.
여기서 “얼굴 역량”은 비디오 생성에서의 인물 외관 일관성, 얼굴 디테일 및 연기 제어를 의미하며, 신원 인식, 얼굴 비교 또는 얼굴 교체 인터페이스를 의미하지 않습니다.
고급 브랜드 단편: 인물, 제품 및 브랜드 자산의 통일
제작 목표: 16:9 고급 패션 브랜드 영상. 황야 도로와 빈티지 자동차로 냉철한 분위기를 구축하고, 여주인공의 외관과 검은색 핸드백 구조를 유지하며, 브랜드 Logo를 결말에 자연스럽게 포함합니다. 이 사례는 샷 간 인물 일관성, 상품 유지, 영화적 질감 및 브랜드 마무리 역량을 중점적으로 검증합니다.
브랜드 단편 직접 열기 또는 다운로드
해당하는
content 구성 방식:
실사 세로형 단편 드라마: 얼굴 일관성과 감정 연기
제작 목표: 15초, 9:16 다크 로맨스 숏드라마 예고편. 남녀 주인공 참고 이미지를 통해 인물 외형을 고정하고, 고성 참고 이미지로 공간을 제약한다. 중근경과 얼굴 클로즈업을 사용해 시선 대치, 공포, 절제와 위험감을 표현한다. 이 사례는 실사 얼굴 이목구비의 안정성, 미세 표정, 시선 관계와 연속 연기를 관찰하기에 적합하다.
실사 숏드라마 직접 열기 또는 다운로드
프롬프트는 단순히 “남녀 대화”를 묘사하는 것이 아니라 인물 관계, 감정과 숏 크기를 명확히 해야 한다:
패션 안경 광고: 얼굴 디테일과 제품 구조 유지
제작 목표: 9:16 고급 패션 안경 광고. 인물 전신 이미지는 체형과 워킹을 담당하고, 얼굴 참고 이미지는 이목구비와 메이크업을 담당하며, 제품 이미지는 곡선, 렌즈 반사, 안경다리와 캣아이 윤곽을 담당한다. 이 사례는 얼굴 근경, 다인 일관성, 착용 관계와 제품 기하학적 구조를 동시에 시험한다.
패션 안경 광고 직접 열기 또는 다운로드
제품 광고에서는 프롬프트가 인물 참고와 제품 참고의 역할을 분리하여 명확하게 작성해야 한다: 인물 소재는 얼굴, 메이크업, 체형과 분위기를 제약하고, 제품 소재는 윤곽, 재질, 반사와 착용 위치를 제약한다. 이는 두루뭉술하게 “안경 광고 하나 생성”이라고 쓰는 것보다 더 안정적이다.
텍스트-비디오 생성
텍스트 항목이 하나뿐인 경우 텍스트-비디오 생성이다. 창의안, 스크립트 또는 숏 설명에서 직접 화면을 생성하기에 적합하다. 프롬프트는 “주체 + 동작 + 장면 + 카메라 + 조명 + 사운드” 순서로 구성할 수 있다."async": true를 추가하면 인터페이스는 즉시 반환한다:
첫 프레임 이미지-비디오 생성
이미지를first_frame으로 표시하면 모델은 해당 화면에서 생성하기 시작한다. 포스터, 제품 이미지, 캐릭터 설정 이미지와 사진 작품을 자연스럽게 움직이게 하기에 적합하다.
마지막 프레임 및 시작·끝 프레임 비디오
last_frame만 제공하면 모델이 지정된 화면까지 자연스럽게 생성할 수 있습니다. first_frame과 last_frame을 동시에 제공하면 시작점과 종점을 명확하게 제어할 수 있습니다. 전환, 형태 변화, 성장 과정 또는 제품 전후 비교에 적합합니다.
멀티모달 참조 기반 비디오 생성
참조 소재는 조합하여 사용할 수 있습니다. 참조 이미지는 캐릭터 또는 제품 외관을 제어하고, 참조 비디오는 동작과 카메라 워크를 제어하며, 참조 오디오는 대사 음색, 음악 또는 편집 리듬을 제어합니다. 프롬프트에서 각 유형의 소재가 무엇을 제어해야 하는지 명확히 설명해야 하며, 소재만 업로드하고 연관 관계를 제공하지 않는 것을 피해야 합니다.콜백 알림
callback_url을 전달하면 비동기 모드가 자동으로 활성화됩니다. 생성 인터페이스는 즉시 task_id와 trace_id를 반환하며, 작업 완료 후 해당 주소로 최종 결과를 POST합니다. 구조는 작업 조회 응답과 동일합니다.
콜백의 최종 상태는 succeeded, failed 또는 cancelled입니다. 콜백을 사용하더라도 task_id를 저장하는 것이 좋습니다. 이를 통해 능동적으로 조회하거나 누락된 알림을 보완할 수 있습니다.
일반적인 오류
동기 응답의
task.status: succeeded는 비디오가 생성되었음을 의미하며, 비동기 확인은 작업이 대기열에 들어갔음을 의미할 뿐입니다. 작업이 최종적으로 성공한 경우에만 과금되며, 작업 조회 자체는 무료이고 중복 차감되지 않습니다.
H3 Max
MiniMax-H3-Max는 480P 또는 768P, 5–15초의 정수 길이를 지원합니다. 오디오 입력은 추가 과금되지 않으며, 처음 2장의 이미지는 무료이고 초과분은 장당 과금됩니다. 참조 비디오는 실제 입력 길이를 기준으로 과금됩니다. 이 모델은 2K를 지원하지 않습니다.
