> ## Documentation Index
> Fetch the complete documentation index at: https://docs.acedata.cloud/llms.txt
> Use this file to discover all available pages before exploring further.

# Guide d’intégration de l’API de génération de vidéos MiniMax H3

> Minimax API guide - Ace Data Cloud

Cet article présente l’intégration et l’utilisation de l’API de génération de vidéos MiniMax H3. Cette interface prend en charge la génération de vidéos à partir de texte, le contrôle des première et dernière images, ainsi que la génération de vidéos à partir de références multimodales, en utilisant une structure V2 multimodale `content` unifiée pour créer les tâches.

## Processus de demande

Pour utiliser l’API de génération de vidéos MiniMax H3, rendez-vous d’abord sur la [console Ace Data Cloud](https://platform.acedata.cloud/console/applications) pour obtenir votre API Token, à conserver en réserve.

![](https://cdn.acedata.cloud/dvc3cg.jpg)

Si vous n’êtes pas encore connecté ou inscrit, vous serez automatiquement redirigé vers la page de connexion qui vous invitera à vous inscrire et à vous connecter ; une fois terminé, vous reviendrez automatiquement sur la page actuelle.

**Un seul API Token permet d’appeler tous les services de la plateforme, sans avoir besoin d’en demander un séparément pour chaque service.** Une première demande offre un quota gratuit, permettant une expérience gratuite ; lorsque le quota est insuffisant, vous pouvez recharger le solde général dans la [console](https://platform.acedata.cloud/console/coin).

> 📘 Documentation complète : [API de génération de vidéos MiniMax H3 →](https://platform.acedata.cloud/documents/minimax-videos-integration)

Il est recommandé d’enregistrer le Token comme variable d’environnement, sans l’écrire dans le code source ni le soumettre à un dépôt de versions :

```bash theme={null}
export ACEDATACLOUD_API_KEY="YOUR_API_KEY"
```

## Vue d’ensemble de l’interface

* **Base URL** : `https://api.acedata.cloud`
* **Endpoint** : `POST /minimax/videos`
* **Méthode d’authentification** : transmettre `authorization: Bearer {token}` dans le HTTP Header
* **En-têtes de requête** :
  * `accept: application/json`
  * `content-type: application/json`
* **Modèle (model)** : `MiniMax-H3`
* **Structure d’entrée** : transmettre uniformément le texte, les images, les vidéos et l’audio via `content`
* **Mode de sortie** : attend par défaut de manière synchrone la fin de la génération et retourne le `task` complet ; en passant `async: true` ou `callback_url`, retourne immédiatement `task_id` et `trace_id`
* **Consultation des résultats** : obtenez le statut et la vidéo finale via l’[API de consultation des tâches MiniMax H3](https://platform.acedata.cloud/documents/minimax-tasks-integration)
* **Rappel asynchrone** : facultatif, recevez le résultat final de la tâche via `callback_url`

Vous n’avez pas besoin de transmettre `action` pour choisir le mode de génération, l’interface déterminera automatiquement son utilisation selon le type de média et le `role` dans `content`.

## Scénarios adaptés

| Scénario | Combinaison d’entrées | Utilisations courantes |
| - | - | - |
| Génération de vidéo à partir de texte | Texte | Créations publicitaires, prévisualisation de storyboard, vidéos courtes, plans d’ambiance |
| Génération de vidéo à partir de l’image initiale | Texte + image initiale | Animer naturellement des images de produits, affiches, photos de personnes ou illustrations |
| Vidéo avec image finale / première et dernière images | Texte + image finale, ou texte + image initiale + image finale | Contrôler le début et la fin, les transitions, les transformations de croissance et les comparaisons avant-après |
| Génération de vidéo à partir de références multimodales | Texte + images / vidéos / audio de référence | Maintenir la cohérence des personnages et produits, reproduire les mouvements, mouvements de caméra, timbres ou rythmes de montage |

## Processus d’appel

Lorsque `async` n’est pas transmis par défaut, `/minimax/videos` attendra la fin de la génération et retournera directement le `task` complet. Lorsqu’il est nécessaire de libérer immédiatement la connexion, transmettez `async: true` ou `callback_url` :

1. Enregistrez `task_id` et `trace_id` dans la réponse immédiate.
2. En l’absence de rappel configuré, appelez `/minimax/tasks` environ toutes les 10 secondes pour effectuer une consultation.
3. Lorsque `task.status` devient `succeeded`, récupérez la vidéo depuis `task.content.url`.
4. Lorsque le statut est `failed` ou `cancelled`, arrêtez l’interrogation et consultez `task.error`.

## Paramètres de requête de niveau supérieur

| Paramètre | Type | Obligatoire | Valeur par défaut | Description |
| - | - | - | - | - |
| `model` | string | Oui | - | Fixé à `MiniMax-H3` |
| `content` | object\[] | Oui | - | Tableau de contenu multimodal, doit contenir un élément `text` non vide |
| `resolution` | string | Oui | - | `768P` ou `2K` |
| `duration` | integer | Oui | - | Durée générée, entier de 4 à 15 secondes |
| `ratio` | string | Obligatoire sous condition | `adaptive` | `adaptive`、`21:9`、`16:9`、`4:3`、`1:1`、`3:4`、`9:16` |
| `async` | boolean | Non | `false` | Lorsque `true`, retourne immédiatement l’identifiant de la tâche, obtenez le résultat via l’interface des tâches |
| `callback_url` | string | Non | - | URL de rappel publique recevant le résultat final de la tâche ; active automatiquement le mode asynchrone après sa fourniture |

Les règles de `ratio` dépendent du flux de travail :

* **Génération de vidéo à partir de texte** : obligatoire et ne peut pas être `adaptive`.
* **Vidéo avec image initiale, image finale ou première et dernière images** : le format est déterminé par l’image d’entrée, il est recommandé de l’omettre ou de transmettre `adaptive`.
* **Génération de vidéo à partir de références multimodales** : peut être omis, la valeur par défaut est `adaptive` ; un ratio fixe peut également être explicitement spécifié.

L’interface n’accepte pas les champs hérités ou de compatibilité, tels que `prompt`, `image_urls`, `audio_urls`, `messages` et `first_frame_image`. Lorsque vous recevez des erreurs liées à ce type de paramètres, supprimez les anciens champs et migrez vers `content` ; par exemple, remplacez `"prompt": "一只猫挥手"` par `"content": [{"type": "text", "text": "一只猫挥手"}]`。N’envoyez pas simultanément les deux nouveaux et anciens formats.

## Paramètres des éléments de contenu content

Chaque élément de contenu doit avoir un `type`, les autres champs étant déterminés par le type :

| `type` | Champ de données | `role` | Description |
| - | - | - | - |
| `text` | `text` | non transmis | Chaque requête doit contenir un élément textuel non vide, de 7 000 caractères maximum |
| `image_url` | `image_url.url` | `first_frame` | Image initiale ; lorsqu’il n’y a qu’une image et que `role` est omis, elle est également traitée comme image initiale |
| `image_url` | `image_url.url` | `last_frame` | Image finale ; peut être utilisée seule ou combinée avec `first_frame` pour contrôler le point de départ et le point final |
| `image_url` | `image_url.url` | `reference_image` | Référence de sujet, personnage, produit, vêtement, scène ou style |
| `video_url` | `video_url.url` | `reference_video` | Référence de mouvement, mouvement de caméra, performance ou structure de montage |
| `audio_url` | `audio_url.url` | `reference_audio` | Référence de timbre, dialogue, musique ou rythme |

Les adresses média prennent en charge trois formats :

* URL HTTPS accessible publiquement, recommandée pour les fichiers volumineux.
* `mm_file://{file_id}`, référence à un fichier déjà téléversé ou à un résultat existant.
* URI data Base64 du type de média correspondant. Base64 augmente la taille d’environ un tiers, assurez-vous que l’ensemble du corps de la requête ne dépasse pas 64 MB.

## Spécifications des médias et limites de quantité

| Ressource | Format | Limite par fichier | Dimensions / durée | Limite de quantité |
| - | - | - | - | - |
| Image | JPG、JPEG、PNG、WEBP、HEIC、HEIF | Ne dépasse pas 30 MB | Largeur et hauteur comprises entre 256 et 5760 px；rapport largeur/hauteur 0.4-2.5 | 1 image maximum pour la première image, 1 image maximum pour la dernière image, 9 images de référence maximum |
| Vidéo | MP4、MOV；H.264/AVC ou H.265/HEVC；piste audio AAC ou MP3 | Ne dépasse pas 50 MB | 2-15 secondes par segment, 15 secondes au total maximum；largeur et hauteur comprises entre 256 et 5760 px；rapport largeur/hauteur 0.4-2.5；23.976-60 fps | 3 vidéos de référence maximum |
| Audio | WAV、MP3 | Ne dépasse pas 15 MB | 2-15 secondes par segment, 15 secondes au total maximum | 3 audios de référence maximum |

Les images, vidéos et audios dans les scénarios de référence multimodaux totalisent au maximum 12 fichiers. Les scénarios de première et dernière image sont mutuellement exclusifs avec les scénarios de ressources de référence : dès lors que `reference_image`, `reference_video` ou `reference_audio` est utilisé, `first_frame` ou `last_frame` ne peut plus être utilisé, et inversement.

## Présentation des capacités de niveau production

Les éléments ci-dessous ne sont pas des maquettes conceptuelles ni des ressources de substitution, mais de véritables entrées de référence et sorties vidéo réelles d’échantillons officiels des capacités de niveau production de MiniMax H3. Les trois groupes de cas couvrent respectivement les films de marque, les récits avec acteurs réels et l’e-commerce de mode, et conviennent pour évaluer les capacités les plus cruciales du modèle dans la production commerciale.

| Capacité | Points d’observation clés |
| - | - |
| Cohérence des personnages et des visages | Stabilité des traits du visage, de la coiffure, du maquillage et du tempérament du personnage après les changements de plans |
| Jeu facial | Regard, micro-expressions, tension émotionnelle et mouvements naturels de la tête dans les plans rapprochés |
| Préservation de la structure du produit | Contours, matériaux, relation de port et reflets de miroir de produits tels que les lunettes et les sacs à main |
| Exécution visuelle de la marque | Cohérence de l’atmosphère de la scène, du grain cinématographique, des couleurs, du logo et du rythme de montage |
| Narration cinématographique | Capacité des variations d’échelle de plan, de la direction des personnages, des mouvements de caméra, du rythme et du son à former une séquence complète |

Ici, les « capacités faciales » désignent la cohérence de l’apparence des personnages, les détails du visage et le contrôle de l’interprétation dans la génération vidéo ; il ne s’agit pas de reconnaissance d’identité, de comparaison faciale ou d’interface d’échange de visage.

### Film court de marque haut de gamme : unification des personnages, des produits et des actifs de marque

**Objectif de production :** Film de marque de mode haut de gamme en 16:9. Établir une atmosphère froide à l’aide d’une route désertique et d’une voiture vintage, préserver l’apparence de l’héroïne et la structure du sac à main noir, et intégrer naturellement le logo de la marque à la fin. Ce cas teste principalement la cohérence des personnages entre les plans, la préservation du produit, la texture cinématographique et la capacité à conclure avec la marque.

| Référence d’ambiance et de scène | Référence du personnage |
| - | - |
| <img src="https://cdn.acedata.cloud/uploads/6e65f865-f1c2-4f80-8b51-9a98d4d930b1" alt="Référence d’ambiance de film de marque avec route désertique et voiture vintage" width="420" /> | <img src="https://cdn.acedata.cloud/uploads/88d89cc3-e6cb-42b4-ab4c-1bbbf6c9f7c8" alt="Référence de l’héroïne du film de marque" width="420" /> |

| Référence du produit sac à main | Référence du logo de la marque |
| - | - |
| <img src="https://cdn.acedata.cloud/uploads/e91f7fff-f8e3-4da5-b882-87edbc3c9473" alt="Référence du produit sac à main noir" width="420" /> | <img src="https://cdn.acedata.cloud/uploads/b68dac43-fb14-42b5-bf8b-fd4d65506520" alt="Référence du logo de la marque" width="420" /> |

<video controls playsinline preload="metadata" poster="https://cdn.acedata.cloud/uploads/6e65f865-f1c2-4f80-8b51-9a98d4d930b1" style="display: block; width: 100%; max-width: 1080px; height: auto; margin: 16px auto; border-radius: 8px;" src="https://cdn.acedata.cloud/uploads/6845b11d-1a58-4478-afd8-29e7e117772a" />

[Ouvrir directement ou télécharger le film court de marque](https://cdn.acedata.cloud/uploads/6845b11d-1a58-4478-afd8-29e7e117772a)

La structure `content` correspondante :

```json theme={null}
{
  "model": "MiniMax-H3",
  "content": [
    {
      "type": "text",
      "text": "15 秒、16:9 高级时装品牌片。荒漠公路旁停着复古汽车，女主从后备箱取出黑色手袋，与男主短暂对视后独自离开。保持人物、手袋与品牌视觉一致；冷峻高级，电影颗粒，剪辑利落，结尾自然呈现品牌 Logo。"
    },
    {
      "type": "image_url",
      "image_url": { "url": "https://cdn.acedata.cloud/uploads/6e65f865-f1c2-4f80-8b51-9a98d4d930b1" },
      "role": "reference_image"
    },
    {
      "type": "image_url",
      "image_url": { "url": "https://cdn.acedata.cloud/uploads/88d89cc3-e6cb-42b4-ab4c-1bbbf6c9f7c8" },
      "role": "reference_image"
    },
    {
      "type": "image_url",
      "image_url": { "url": "https://cdn.acedata.cloud/uploads/e91f7fff-f8e3-4da5-b882-87edbc3c9473" },
      "role": "reference_image"
    },
    {
      "type": "image_url",
      "image_url": { "url": "https://cdn.acedata.cloud/uploads/b68dac43-fb14-42b5-bf8b-fd4d65506520" },
      "role": "reference_image"
    }
  ],
  "resolution": "2K",
  "duration": 15,
  "ratio": "16:9"
}
```

### Mini-série verticale avec acteurs réels : cohérence faciale et interprétation émotionnelle

**Objectif de production :** Bande-annonce de court métrage romantique sombre de 15 secondes, au format 9:16. Verrouillez l’apparence des personnages à l’aide des images de référence des protagonistes masculin et féminin, et contraignez l’espace à l’aide de l’image de référence du château ; utilisez des plans moyens rapprochés et des gros plans du visage pour exprimer la confrontation des regards, la peur, la retenue et le sentiment de danger. Ce cas est adapté à l’observation de la stabilité des traits du visage de personnes réelles, des micro-expressions, des relations de regard et de la continuité de l’interprétation.

| Référence des protagonistes masculin et féminin | Référence de la scène du château sombre |
| - | - |
| <img src="https://cdn.acedata.cloud/uploads/f772a484-9ca5-46dd-b4a4-bb3b62d20086" alt="Référence des protagonistes masculin et féminin d’un court métrage en prises de vues réelles" width="420" /> | <img src="https://cdn.acedata.cloud/uploads/2305899b-8f5d-46e5-bba0-abd8d185691c" alt="Référence de scène de château sombre" width="420" /> |

<video controls playsinline preload="metadata" poster="https://cdn.acedata.cloud/uploads/f772a484-9ca5-46dd-b4a4-bb3b62d20086" style="display: block; width: 100%; max-width: 520px; height: auto; margin: 16px auto; border-radius: 8px;" src="https://cdn.acedata.cloud/uploads/0f3e9bf2-5073-46f4-9a2d-7d8d912391cf" />

[Ouvrir directement ou télécharger le court métrage en prises de vues réelles](https://cdn.acedata.cloud/uploads/0f3e9bf2-5073-46f4-9a2d-7d8d912391cf)

Le prompt doit clairement préciser la relation entre les personnages, les émotions et l’échelle du plan, plutôt que de simplement décrire « un homme et une femme qui parlent » :

```text theme={null}
Bande-annonce de court métrage romantique sombre en prises de vues réelles de 15 secondes, au format 9:16. L’héroïne entre par erreur dans un château interdit et réveille un aristocrate vampire endormi ;
il s’approche avec danger et retenue, elle a peur mais ne se soumet pas. Maintenir la cohérence des traits du visage, de la coiffure et des vêtements des deux personnages,
utiliser des plans moyens rapprochés et des gros plans du visage pour exprimer la confrontation des regards et la tension émotionnelle, éclairage cinématographique sombre, rythme soutenu.
```

### Publicité de lunettes de mode : maintien des détails du visage et de la structure du produit

**Objectif de production :** Publicité de lunettes de mode haut de gamme au format 9:16. L’image en pied du personnage est responsable de la silhouette et de la démarche, l’image de référence du visage est responsable des traits et du maquillage, et l’image du produit est responsable des courbes enveloppantes, des reflets des verres, des branches et du contour œil-de-chat. Ce cas évalue simultanément les gros plans du visage, la cohérence entre plusieurs personnes, la relation de port et la structure géométrique du produit.

| Référence du mannequin et du style | Référence des détails du visage | Référence du produit de lunettes |
| - | - | - |
| <img src="https://cdn.acedata.cloud/uploads/d1e00670-b618-4989-8daf-e2f57ee863ff" alt="Référence du mannequin et du style pour une publicité de mode" width="280" /> | <img src="https://cdn.acedata.cloud/uploads/6371092e-58be-4a74-9492-b9de1847af8a" alt="Référence des détails du visage du mannequin" width="280" /> | <img src="https://cdn.acedata.cloud/uploads/4de062a9-ceb4-4619-bde1-6d90e4b19dad" alt="Référence de la structure du produit de lunettes" width="280" /> |

<video controls playsinline preload="metadata" poster="https://cdn.acedata.cloud/uploads/d1e00670-b618-4989-8daf-e2f57ee863ff" style="display: block; width: 100%; max-width: 520px; height: auto; margin: 16px auto; border-radius: 8px;" src="https://cdn.acedata.cloud/uploads/55715089-b6bd-4ef6-a3c2-e762a672f751" />

[Ouvrir directement ou télécharger la publicité de lunettes de mode](https://cdn.acedata.cloud/uploads/55715089-b6bd-4ef6-a3c2-e762a672f751)

Dans les publicités de produits, le prompt doit clairement séparer les rôles des références de personnages et des références de produits : les ressources de personnages contraignent le visage, le maquillage, la silhouette et le tempérament ; les ressources de produits contraignent le contour, le matériau, les reflets et la position de port. Cela est plus stable que d’écrire vaguement « générer une publicité de lunettes ».

## Texte vers vidéo

Lorsqu’il n’y a qu’un seul élément de texte, il s’agit d’une génération de vidéo à partir de texte. Cela convient pour générer directement des images à partir d’une idée créative, d’un script ou d’une description de plan. Le prompt peut être organisé selon l’ordre « sujet + action + scène + caméra + lumière + son ».

```bash theme={null}
curl -X POST 'https://api.acedata.cloud/minimax/videos' \
  -H "Authorization: Bearer $ACEDATACLOUD_API_KEY" \
  -H 'Content-Type: application/json' \
  -d '{
    "model": "MiniMax-H3",
    "content": [
      {
        "type": "text",
        "text": "Publicité de parfum cinématographique de 15 secondes : sur des rochers noirs de la côte au petit matin, un flacon de parfum transparent est entouré de brume légère et de vagues. Un plan macro révèle les gouttelettes d’eau sur le flacon et la réfraction du verre, la caméra s’élève lentement d’un gros plan du produit vers l’immensité de la mer ; tons argentés et bleus, lumière naturelle réaliste, élégance haut de gamme et retenue, arrêt sur image du produit à la fin."
      }
    ],
    "resolution": "2K",
    "duration": 15,
    "ratio": "16:9"
  }'
```

Le mode synchrone par défaut renvoie la tâche complète une fois la génération terminée :

```json theme={null}
{
  "task": {
    "id": "f5977217-ed2c-40da-adbe-93d08235618f",
    "model": "MiniMax-H3",
    "status": "succeeded",
    "content": { "url": "https://cdn.acedata.cloud/minimax/f5977217.mp4" },
    "resolution": "2K",
    "duration": 15,
    "ratio": "16:9"
  }
}
```

Si vous ajoutez `"async": true` à la requête, l’interface renvoie immédiatement :

```json theme={null}
{
  "task_id": "f5977217-ed2c-40da-adbe-93d08235618f",
  "trace_id": "trace_7f8c2b1a"
}
```

## Image de première image vers vidéo

Marquez une image comme `first_frame`, et le modèle commencera à générer à partir de cette image. Cela convient pour donner naturellement du mouvement à des affiches, des images de produits, des illustrations de personnages et des œuvres photographiques.

```json theme={null}
{
  "model": "MiniMax-H3",
  "content": [
    {
      "type": "text",
      "text": "Le personnage respire naturellement et regarde par la fenêtre, le bas de ses vêtements est soulevé par une légère brise, la caméra avance lentement"
    },
    {
      "type": "image_url",
      "image_url": {
        "url": "https://cdn.acedata.cloud/b1c82e4937.png"
      },
      "role": "first_frame"
    }
  ],
  "resolution": "2K",
  "duration": 5,
  "ratio": "adaptive"
}
```

## Vidéo avec image finale et images initiale et finale

Fournir uniquement `last_frame` permet au modèle de générer naturellement jusqu’à l’image spécifiée ; fournir simultanément `first_frame` et `last_frame` permet de contrôler clairement le point de départ et le point d’arrivée. Convient aux transitions, aux changements de forme, aux processus de croissance ou aux comparaisons avant/après de produits.

```json theme={null}
{
  "model": "MiniMax-H3",
  "content": [
    {
      "type": "text",
      "text": "女孩从童年自然成长为青年，时间流逝平滑，人物始终位于画面中央"
    },
    {
      "type": "image_url",
      "image_url": { "url": "YOUR_FIRST_FRAME_URL" },
      "role": "first_frame"
    },
    {
      "type": "image_url",
      "image_url": { "url": "YOUR_LAST_FRAME_URL" },
      "role": "last_frame"
    }
  ],
  "resolution": "2K",
  "duration": 5,
  "ratio": "adaptive"
}
```

Les dimensions et le rapport largeur/hauteur de la première et de la dernière image doivent être aussi cohérents que possible, et les différences de position du sujet, de composition et d’éclairage ne doivent pas être trop importantes ; il est ainsi plus facile d’obtenir une transition naturelle.

## Génération vidéo à partir de références multimodales

Les supports de référence peuvent être combinés : les images de référence contrôlent l’apparence du personnage ou du produit, les vidéos de référence contrôlent les mouvements et les mouvements de caméra, et les audios de référence contrôlent le timbre des dialogues, la musique ou le rythme du montage. Le prompt doit clairement indiquer ce que chaque type de support doit contrôler, afin d’éviter de simplement téléverser des supports sans fournir de relation entre eux.

```json theme={null}
{
  "model": "MiniMax-H3",
  "content": [
    {
      "type": "text",
      "text": "保持参考人物的五官、发型与服装一致，按照参考视频中的表演动作完成时尚短片；镜头节奏跟随参考音频，近景突出自然面部表情"
    },
    {
      "type": "image_url",
      "image_url": { "url": "YOUR_CHARACTER_IMAGE_URL" },
      "role": "reference_image"
    },
    {
      "type": "video_url",
      "video_url": { "url": "YOUR_PERFORMANCE_VIDEO_URL" },
      "role": "reference_video"
    },
    {
      "type": "audio_url",
      "audio_url": { "url": "YOUR_AUDIO_URL" },
      "role": "reference_audio"
    }
  ],
  "resolution": "2K",
  "duration": 5,
  "ratio": "adaptive"
}
```

## Notification de rappel

La transmission de `callback_url` active automatiquement le mode asynchrone : l’interface de création renvoie immédiatement `task_id` et `trace_id`, et envoie le résultat final par POST à cette adresse une fois la tâche terminée ; la structure est identique à celle de la réponse de requête de tâche.

Les états finaux dans le rappel sont `succeeded`, `failed` ou `cancelled`. Même en utilisant un rappel, il est recommandé de sauvegarder `task_id`, afin d’effectuer des requêtes actives ou de compenser les notifications manquées.

## Erreurs courantes

| Code d’état HTTP | Signification | Recommandation de traitement |
| - | - | - |
| `400` | Erreur de paramètre ou combinaison de supports invalide | Vérifiez les champs obligatoires, `role`, le nombre et le format des supports |
| `401` | Token manquant ou invalide | Vérifiez `Authorization: Bearer ...` |
| `402` | Solde ou quota insuffisant | Approvisionnez le solde général dans la console |
| `422` | Échec du contrôle de sécurité du contenu | Ajustez le prompt ou les supports, puis soumettez à nouveau |
| `429` | Requêtes trop fréquentes | Réessayez après une temporisation exponentielle ; un intervalle d’environ 10 secondes est recommandé pour l’interrogation des tâches |
| `500` | Service temporairement indisponible | Conservez les informations de la requête et réessayez plus tard |

Dans une réponse synchrone, `task.status: succeeded` indique que la vidéo a été générée ; la confirmation asynchrone indique seulement que la tâche est entrée dans la file d’attente. La facturation n’a lieu que lorsque la tâche réussit finalement ; la requête de tâche elle-même est gratuite et ne génère pas de frais répétés.

### H3 Max

`MiniMax-H3-Max` prend en charge une résolution de 480P ou 768P, ainsi que des durées entières de 5 à 15 secondes. Les entrées audio ne sont pas facturées en supplément, les 2 premières images sont gratuites et les images supplémentaires sont facturées une par une ; les vidéos de référence sont facturées selon leur durée réelle d’entrée. Ce modèle ne prend pas en charge la 2K.


This documentation is built and hosted on [Mintlify](https://mintlify.com), a developer documentation platform.