content для создания задач.
Процесс получения доступа
Чтобы использовать API генерации видео MiniMax H3, сначала получите ваш API Token в консоли Ace Data Cloud и сохраните его для дальнейшего использования.
Если вы ещё не вошли в систему или не зарегистрировались, вы будете автоматически перенаправлены на страницу входа, где вам будет предложено зарегистрироваться и войти; после завершения вы автоматически вернётесь на текущую страницу.
Один API Token позволяет вызывать все сервисы платформы, без необходимости подавать отдельную заявку для каждого сервиса. При первом получении предоставляется бесплатная квота для бесплатного ознакомления; при недостатке квоты вы можете пополнить общий баланс в консоли.
📘 Полная документация: API генерации видео MiniMax H3 →Рекомендуется сохранить Token как переменную окружения, не записывать его в исходный код и не отправлять в репозиторий версий:
Обзор интерфейса
- Base URL:
https://api.acedata.cloud - Endpoint:
POST /minimax/videos - Способ аутентификации: передавайте
authorization: Bearer {token}в HTTP Header - Заголовки запроса:
accept: application/jsoncontent-type: application/json
- Модель (model):
MiniMax-H3 - Структура ввода: текст, изображения, видео и аудио унифицированно передаются через
content - Режим вывода: по умолчанию синхронно ожидает завершения генерации и возвращает полный
task; при передачеasync: trueилиcallback_urlнемедленно возвращаетtask_idиtrace_id - Запрос результата: получите статус и готовое видео через API запроса задач MiniMax H3
- Асинхронный callback: необязательно, получайте финальный результат задачи через
callback_url
action для выбора режима генерации, интерфейс автоматически определит назначение на основе типа материалов и role в content.
Для каких сценариев подходит
Процесс вызова
Еслиasync по умолчанию не передаётся, /minimax/videos будет ожидать завершения генерации и напрямую вернёт полный task. Если нужно немедленно освободить соединение, передайте async: true или callback_url:
- Сохраните
task_idиtrace_idиз немедленного ответа. - Если callback не настроен, примерно каждые 10 секунд вызывайте
/minimax/tasksдля выполнения запроса. - Когда
task.statusстанетsucceeded, получите видео изtask.content.url. - Когда статус равен
failedилиcancelled, прекратите опрос и прочитайтеtask.error.
Параметры запроса верхнего уровня
Правила для
ratio зависят от рабочего процесса:
- Генерация видео по тексту: обязательный параметр и не может быть
adaptive. - Видео с первым кадром, последним кадром или первым и последним кадрами: соотношение сторон определяется входным изображением, рекомендуется опустить параметр или передать
adaptive. - Генерация видео по мультимодальным референсам: можно опустить, по умолчанию
adaptive; также можно явно указать фиксированное соотношение.
prompt, image_urls, audio_urls, messages и first_frame_image. При получении ошибки таких параметров удалите устаревшие поля и перенесите их в content; например, замените "prompt": "Кошка машет лапой" на "content": [{"type": "text", "text": "Кошка машет лапой"}]. Не отправляйте одновременно оба формата — новый и старый.
Параметры элементов контента content
Каждый элемент контента должен иметьtype, остальные поля определяются типом:
Адреса медиа поддерживают три формы:
- Публично доступный HTTPS URL, рекомендуется для больших файлов.
mm_file://{file_id}, ссылка на уже загруженный файл или существующий результат.- Base64 data URI соответствующего типа медиа. Base64 увеличивает размер примерно на треть, убедитесь, что весь body запроса не превышает 64 MB.
Спецификации материалов и ограничения по количеству
В мультимодальном референсном сценарии общее количество изображений, видео и аудио составляет не более 12 файлов. Сценарий с первым и последним кадрами и сценарий с референсными материалами взаимоисключающие: при использовании
reference_image, reference_video или reference_audio больше нельзя использовать first_frame или last_frame, и наоборот.
Демонстрация возможностей производственного уровня
Ниже приведены не концепт-арты и не материалы-заполнители, а реальные референсные входные данные и фактические видео-результаты официальных примеров возможностей MiniMax H3 производственного уровня. Три группы кейсов соответственно охватывают брендовые короткометражные фильмы, повествование с реальными людьми и модную электронную коммерцию, и подходят для оценки наиболее ключевых возможностей модели в коммерческом производстве.
Под «возможностями работы с лицами» здесь понимаются согласованность внешности персонажей, детализация лиц и управление актёрской игрой при генерации видео, а не распознавание личности, сопоставление лиц или интерфейс замены лиц.
Короткометражный фильм премиального бренда: единство персонажей, продукта и бренд-активов
Цель производства: модный брендовый фильм премиального уровня в формате 16:9. Создать холодную атмосферу с помощью пустынной дороги и винтажного автомобиля, сохранить внешность главной героини и структуру чёрной сумки, а также естественно включить Logo бренда в финал. Этот кейс главным образом проверяет согласованность персонажей между кадрами, сохранение товара, кинематографичность и способность завершать ролик брендингом.
Открыть или скачать брендовый короткометражный фильм напрямую
Соответствующий способ организации
content:
Вертикальная короткая драма с реальными людьми: согласованность лиц и эмоциональная игра
Цель создания: 15-секундный, 9:16 трейлер тёмной романтической короткой драмы. Внешность персонажей фиксируется с помощью референсов главных героев, а пространство ограничивается референсом старинного замка; используйте средние крупные планы и крупные планы лиц, чтобы передать противостояние взглядами, страх, сдержанность и ощущение опасности. Этот пример подходит для наблюдения за стабильностью черт лица реальных людей, микровыражениями, отношением взглядов и последовательной игрой.
Открыть или скачать короткую драму с реальными актёрами напрямую
В промпте следует чётко указать отношения персонажей, эмоции и крупность плана, а не просто описывать «диалог мужчины и женщины»:
Реклама модных очков: сохранение деталей лица и структуры товара
Цель создания: премиальная реклама модных очков в формате 9:16. Изображение модели в полный рост отвечает за телосложение и походку, референс лица — за черты и макияж, а изображение продукта — за изгиб оправы, отражения линз, дужки и контур «кошачий глаз». Этот пример одновременно проверяет крупные планы лица, согласованность нескольких людей, связь с носимым предметом и геометрическую структуру товара.
Открыть или скачать рекламу модных очков напрямую
В товарной рекламе промпт должен чётко разделять роли референсов персонажа и продукта: материалы персонажа ограничивают лицо, макияж, телосложение и характер; материалы продукта ограничивают контур, материал, отражения и положение при ношении. Это стабильнее, чем расплывчато писать «сгенерировать рекламу очков».
Генерация видео из текста
Если имеется только один текстовый элемент, это генерация видео из текста. Подходит для непосредственного создания изображения на основе идеи, сценария или описания кадра. Промпт можно организовать в порядке «субъект + действие + сцена + камера + свет + звук»."async": true, интерфейс немедленно вернёт:
Генерация видео из изображения первого кадра
Отметьте изображение какfirst_frame, и модель начнёт генерацию с этого кадра. Подходит для естественного оживления постеров, изображений товаров, концепт-артов персонажей и фотографических работ.
Видео с последним кадром и первым-последним кадрами
Предоставление толькоlast_frame позволяет модели естественным образом сгенерировать видео до указанного кадра; одновременное предоставление first_frame и last_frame позволяет точно контролировать начальную и конечную точки. Подходит для переходов, изменений формы, процесса роста или сравнения продукта до и после.
Генерация видео по мультимодальным референсам
Референсные материалы можно использовать в комбинации: референсные изображения управляют внешним видом персонажа или продукта, референсные видео — движениями и движением камеры, референсное аудио — тембром реплик, музыкой или ритмом монтажа. В промпте следует чётко указать, чем должен управлять каждый тип материала, чтобы не просто загрузить материалы без указания взаимосвязей.Уведомления обратного вызова
Передачаcallback_url автоматически включает асинхронный режим: интерфейс создания сразу возвращает task_id и trace_id, а после завершения задачи отправляет итоговый результат методом POST на этот адрес; структура результата совпадает с ответом запроса задачи.
Итоговый статус в обратном вызове — succeeded, failed или cancelled. Даже при использовании обратного вызова рекомендуется сохранять task_id, чтобы иметь возможность выполнить активный запрос или компенсировать пропущенные уведомления.
Распространённые ошибки
task.status: succeeded в синхронном ответе означает, что видео уже сгенерировано; асинхронное подтверждение означает только то, что задача поставлена в очередь. Плата взимается только при окончательном успешном завершении задачи; запросы задач бесплатны и не приводят к повторному списанию средств.
H3 Max
MiniMax-H3-Max поддерживает разрешение 480P или 768P и целочисленную длительность от 5 до 15 секунд. За аудиовход дополнительная плата не взимается, первые 2 изображения бесплатны, а за каждое последующее взимается плата; референсное видео тарифицируется по фактической длительности входного материала. Эта модель не поддерживает 2K.
