Vidéo de référence MiniMax H3 : exemples, conseils et comparaison avec Seedance
Une vidéo de référence MiniMax H3 est utile lorsqu'un mouvement est plus simple à montrer qu'à décrire. Un clip court peut transmettre la mécanique du corps, le rythme d'un objet, la vitesse de caméra, un changement de cadrage ou la cadence d'un montage. La source montre comment l'action évolue. Le prompt précise le nouveau sujet, la scène, le rôle de chaque référence et les détails à conserver. Commencez par un clip court, autorisé et centré sur une seule action lisible. Séparez ensuite le sujet, l'action, la caméra et le décor. Le flux H3 actuel de SeedVideo AI produit des clips 2K de 5 à 15 secondes et peut combiner du texte avec des références image, vidéo et audio. Ce guide couvre la préparation des sources, la rédaction du prompt, le diagnostic des écarts, des exemples et une comparaison neutre avec Seedance 2.5.

Prompt vidéo : plan-séquence cinématographique en prise de vue réelle. Un danseur adulte fictif portant un manteau cramoisi effectue un saut tourné maîtrisé sur une scène assombrie par la pluie. Suivi latéral depuis un angle bas, à vitesse régulière. Conserver le visage, le manteau, le sens du déplacement et la disposition de la scène. Lumière latérale tungstène chaude, contre-jour bleu froid, mouvement naturel du tissu, grain 35 mm discret, sans coupe ni titre.
En bref
- Utilisez une vidéo de référence pour un mouvement, un trajet de caméra, un rythme ou un minutage difficile à décrire.
- Choisissez un clip court avec une action unique, un sujet dégagé et un mouvement de caméra que vous savez nommer.
- Donnez une seule fonction principale à chaque fichier, par exemple : « Video 1 contrôle uniquement le mouvement ».
- En cas de dérive, simplifiez la source et les consignes, puis ne modifiez qu'un contrôle à la fois.
- MiniMax H3 convient aux plans audiovisuels 2K compacts. Seedance 2.5 convient aux scènes plus longues, aux ensembles de références plus vastes et aux retouches localisées.
Réponse rapide
Partez de cette formule :
Créer [nouveau sujet] dans [nouveau décor]. Utiliser Video 1 uniquement pour [mouvement du corps ou trajet de caméra]. Conserver [repères d'identité]. L'action commence par [état], passe par [moment clé] et se termine par [état]. Caméra : [un mouvement, une vitesse, un cadrage]. Lumière : [source et direction]. Son : [dialogue, effets, ambiance ou musique].
Le mot uniquement limite le rôle de la source. Vérifiez les limites d'entrée, la durée, la résolution et le tarif en crédits sur la page du modèle MiniMax H3.
Ce qu'une vidéo de référence peut contrôler
Le clip agit comme une instruction temporelle. Il montre des changements qu'une image fixe ne peut pas transmettre : transfert de poids, rotation d'un produit, accélération, montée de caméra ou révélation à un moment précis.
| Contrôle | Ce que communique la source | Ce que le prompt doit encore préciser |
|---|---|---|
| Mouvement du corps | Ordre des poses, poids, vitesse et direction | Nouveau sujet, tenue, décor et phases à conserver |
| Mouvement d'objet | Rotation, chute, rebond, ouverture ou transformation | Forme, matière, couleur et état final |
| Trajet de caméra | Travelling, orbite, poussée, recul, panoramique ou grue | Vitesse, cible du cadrage et composition de départ ou d'arrivée |
| Rythme | Pauses, accélérations, ralentissements et moment de révélation | Étapes indispensables et étapes supprimables |
| Montage | Ordre des coupes et cadence approximative | Nouveau contenu et rôle de chaque coupe |
Une référence n'est pas un contrat image par image. H3 crée un nouveau clip et peut réinterpréter une pose, un rythme, une profondeur ou une distance de caméra. Utilisez la source comme direction, puis évaluez le résultat avec une courte grille stable.
Distinguer mouvement et identité
Une vidéo peut expliquer un saut sans définir la personne qui saute. Si le personnage doit rester reconnaissable, ajoutez une image d'identité nette et attribuez-lui un rôle précis. Image 1 peut contrôler le visage et la tenue, Video 1 le saut et le suivi latéral, et le prompt le lieu, la lumière et la pose finale.
Si la source montre un autre interprète, d'autres vêtements et un autre arrière-plan, évitez « refaire exactement la même chose avec mon personnage ». Décrivez plutôt les éléments transférables : trois pas de course, impulsion du pied droit, position groupée, réception sur deux pieds et suivi de gauche à droite.
Comment choisir une bonne référence de mouvement
La meilleure source n'est pas forcément la plus soignée. Elle est facile à lire. Une vidéo de téléphone devant un mur uni peut être plus utile qu'un clip musical avec des coupes rapides, de la fumée, des lumières mobiles et plusieurs personnes.

Prompt vidéo : plan-séquence sportif réaliste. Un athlète adulte fictif en tenue anthracite fait deux pas et franchit une barrière basse en béton de gauche à droite. Suivi latéral à hauteur de taille avec le corps entier visible. Lumière matinale dure, ombres longues, flou de mouvement contenu, place brutaliste simple, une seule prise.
Rechercher une silhouette lisible
Les mains, les pieds, les accessoires et la ligne principale de l'action doivent rester visibles. Lorsque les membres se superposent pendant la majeure partie du clip, le mouvement devient plus difficile à interpréter. Une vue latérale ou trois quarts fonctionne souvent bien pour la course, la danse, le port d'un objet et la rotation d'un produit.
Garder un clip court et ciblé
Supprimez l'attente avant l'action et après la pose finale. Le flux H3 actuel de SeedVideo AI accepte jusqu'à trois vidéos, chacune de 2 à 15 secondes, avec 15 secondes de vidéo au total. Plusieurs fichiers ne sont utiles que si chacun apporte une instruction distincte.
Préférer une exposition stable et des contacts visibles
Une lumière qui scintille peut être interprétée comme une consigne de style. Un flou fort peut masquer la position des membres. Rendez visibles les points de contact : le pied qui donne l'impulsion, la main qui ouvre un couvercle ou les roues qui touchent le sol.
Utiliser des sources autorisées
Employez vos propres séquences, du contenu commandé ou des images correctement licenciées. Vérifiez les droits avant d'utiliser une performance reconnaissable, une ressource de marque ou l'image d'une personne privée.
Séparer sujet, action, caméra et scène
De nombreux échecs cachent une contradiction. L'image d'identité montre un portrait en studio, la vidéo un athlète masqué, le prompt demande un marché bondé et la caméra doit être à la fois fixe et en orbite rapide. Une carte des rôles révèle ces conflits avant la génération.
| Couche | Décision à prendre | Exemple de consigne |
|---|---|---|
| Sujet | Visage, vêtements, géométrie du produit et accessoires fixes | « Image 1 définit le visage, les boucles courtes et le tailleur moutarde » |
| Action | Un mouvement et ses phases obligatoires | « Video 1 définit le rythme de marche et le balancement des bras » |
| Caméra | Un mouvement principal, sa vitesse et sa cible | « Reculer doucement en gardant un cadre aux genoux » |
| Scène | Lieu, profondeur, lumière et éléments mobiles | « Galerie en pierre claire, lumière zénithale, passage vide » |
| Son | Bruitages, ambiance, dialogue ou musique | « Pas discrets et ambiance de salle, sans dialogue » |
Écrivez une phrase par couche. Si deux références contrôlent la même couche, supprimez-en une ou indiquez une priorité. Le guide de prompting MiniMax H3 développe cette méthode.
Un prompt compact avec vidéo de référence
Créer un plan de mode cinématographique avec la femme d'Image 1 dans une galerie en pierre claire. Utiliser Video 1 uniquement pour son rythme de marche régulier et le mouvement naturel des bras. Ne pas reprendre le lieu ni les vêtements de la source. La caméra recule à la même vitesse dans un cadre aux genoux. Conserver son visage, ses boucles courtes, son tailleur moutarde et le sens de marche. Lumière zénithale douce, pas discrets, sans coupe.
Utiliser l'espace MiniMax H3 actuel
L'entrée Reference Video de SeedVideo AI affiche la vidéo obligatoire, la zone de prompt, le format, la sortie 2K, la durée, le modèle et le tarif en crédits. La vue ci-dessous montre MiniMax H3 en 16:9, sur 5 secondes et en 2K. Le tarif peut changer selon la durée et les références facturables, donc relisez-le après chaque ajout.

Espace Reference Video MiniMax H3 actuel de SeedVideo AI, vérifié le 9 septembre 2026.
Ouvrez le générateur vidéo vers vidéo IA, choisissez MiniMax H3 et ajoutez le clip le plus court qui montre l'action centrale. Si l'identité dépend d'une image fixe, préparez-la dans le générateur image vers vidéo IA. Pour un plan qui ne nécessite aucun mouvement de référence, utilisez le générateur texte vers vidéo IA.
Méthode en cinq étapes
1. Décrire le plan cible avant de chercher une source
Résumez le sujet, l'action, le lieu et la caméra en une phrase. Vous éviterez de choisir un clip spectaculaire qui ne résout pas le besoin réel.
2. Nommer l'unique fonction principale de la vidéo
Choisissez le mouvement du corps, le mouvement d'un objet, le trajet de caméra, le rythme ou le montage. Si deux contrôles sont nécessaires, vérifiez qu'ils sont compatibles dans la source.
3. Couper et observer la source
Gardez l'action utile et examinez la première et la dernière image. Notez le sens du déplacement, les contacts, les pauses, les occultations et les changements de caméra. Transformez ces observations en consignes.
4. Construire le prompt par couches
Écrivez d'abord le nouveau sujet et le nouvel environnement. Attribuez le rôle de la référence. Ajoutez la séquence d'action, une consigne de caméra, la lumière, le son et les règles de conservation.
5. Évaluer avec la même grille
Contrôlez l'identité, l'ordre du mouvement, le trajet de caméra, la logique spatiale, la stabilité du fond et le son. Relevez l'écart principal et ne modifiez qu'une couche pour la version suivante.
Corriger la dérive et les conflits

Prompt vidéo : plan-séquence de mode haut de gamme. Une femme adulte fictive aux boucles brunes courtes, vêtue d'un tailleur moutarde, marche dans une galerie en pierre claire. La caméra recule doucement et la garde au centre. Conserver le visage, la tenue, le sens de marche, les colonnes répétées et la lumière zénithale douce. Pas naturels, reflets réalistes au sol, sans coupe.
| Symptôme | Conflit probable | Révision ciblée |
|---|---|---|
| Le visage ou la tenue change | La vidéo est aussi traitée comme une identité | Ajouter une image nette et réserver Video 1 au mouvement |
| L'action devient générique | La source contient des coupes, des occultations ou plusieurs actions | Couper jusqu'à une action complète et décrire ses phases |
| La caméra ignore la source | Le prompt demande un mouvement concurrent | Garder une seule consigne et déclarer la priorité |
| Le fond de la source revient | Le nouveau décor est trop vague | Définir sa géométrie et sa lumière, puis exclure le lieu du rôle vidéo |
| Le sujet glisse | Les contacts des pieds ou des mains sont invisibles | Utiliser un cadre plus large et nommer impulsion, contact et réception |
| Le mouvement se termine trop tôt | Trop d'étapes sont prévues pour la durée | Retirer une action secondaire ou choisir une durée compatible plus longue |
| Le style change en cours de plan | Plusieurs références portent des styles différents | Choisir une seule source de style et décrire physiquement la lumière |
Si le fond de la source revient, remplacez « galerie moderne » par une géométrie concrète : corridor vide en pierre claire, colonnes répétées et puits de lumière. Si le personnage dérive, placez plus tôt le visage, la coiffure, la couleur de la tenue ou la silhouette du produit. La méthode de cohérence des personnages propose une grille plus détaillée.
Exemples pour MiniMax H3
Transposer une danse dans un nouveau lieu
Créer un plan cinématographique du danseur fictif d'Image 1 sur une scène vide et sombre après la pluie. Video 1 contrôle uniquement le tour horaire, le moment du saut et la réception. Suivi de gauche à droite depuis un angle bas et assez large. Conserver le visage, le manteau cramoisi, la scène et le sens du déplacement. Lumière latérale chaude, contre-jour bleu, tissu naturel, sans coupe.
Reprendre un mouvement de parkour avec un autre sujet
Créer un plan sportif réaliste de l'athlète fictif d'Image 1 sur une place brutaliste calme. Video 1 contrôle uniquement les deux pas d'approche, l'impulsion du pied droit, le franchissement et la réception sur deux pieds. Suivi latéral à hauteur de taille, corps entier visible. Tenue anthracite, lumière matinale dure, ombres longues, sans coupe.
Reprendre la caméra sans reprendre l'action
Créer un plan d'architecture de cinq secondes dans une bibliothèque circulaire vide. Video 1 contrôle uniquement l'orbite lente dans le sens horaire et sa courbe d'accélération. Remplacer l'interprète par une chaise rouge immobile au centre. Conserver la forme de la chaise et la géométrie de la bibliothèque. Lumière douce de fenêtre, ambiance calme, sans personne ni coupe.
MiniMax H3 ou Seedance 2.5 pour les références
Les deux modèles profitent de rôles clairs, mais leurs pages actuelles sur SeedVideo AI présentent des cadres de travail différents.
| Décision | MiniMax H3 | Seedance 2.5 |
|---|---|---|
| Durée maximale actuelle | 15 secondes | Jusqu'à 30 secondes |
| Orientation de sortie | Plans courts en 2K natif | Clips plus longs avec réglages de sortie sélectionnables |
| Capacité de référence | Jusqu'à 12 fichiers mixtes : 9 images, 3 vidéos et 3 audios | Jusqu'à 50 références : 30 images, 10 vidéos et 10 audios |
| Bon choix | Plans audiovisuels compacts avec direction précise du mouvement, de la caméra et du son | Publicités longues, séquences narratives, grands ensembles de références et retouches localisées |
| Moins adapté | Long plan continu ou vaste bibliothèque de production | Transfert de mouvement court qui n'a pas besoin d'un grand contexte |
Choisissez MiniMax H3 pour un plan 2K ciblé de 5 à 15 secondes lorsque le mouvement ou la caméra peut être isolé clairement. Choisissez Seedance 2.5 lorsque la scène demande plus de temps, davantage de sources ou des modifications localisées. Le guide référence vers vidéo Seedance 2.5 explique comment répartir les rôles dans un ensemble plus large.
Questions fréquentes
Qu'est-ce qu'une vidéo de référence MiniMax H3 ?
C'est un clip source qui guide des propriétés temporelles comme le mouvement du corps, le mouvement d'un objet, le trajet de caméra, le rythme ou le montage. Le prompt définit le nouveau sujet, la scène et les détails stables.
Quelle doit être la durée de la source ?
Utilisez le clip le plus court contenant une action utile complète. Dans le flux H3 actuel de SeedVideo AI, chaque vidéo peut durer de 2 à 15 secondes, dans une limite totale de 15 secondes.
Une vidéo peut-elle préserver l'identité d'une personne ?
Elle peut influencer l'apparence, mais une image d'identité nette et des repères explicites pour le visage, les cheveux, la tenue et la direction donnent une cible plus claire. Attribuez le mouvement à la vidéo et l'identité à l'image.
Pourquoi H3 reprend-il l'arrière-plan de la source ?
Le rôle de la vidéo est peut-être trop large ou le nouveau décor trop vague. Décrivez la disposition, la lumière et la profondeur, puis précisez que la vidéo contrôle le mouvement ou la caméra, pas le lieu.
Combien de références MiniMax H3 accepte-t-il ?
La page actuelle indique jusqu'à 12 fichiers mixtes, dans les limites de 9 images, 3 vidéos et 3 audios. Les vidéos et les audios ont chacun une limite totale de 15 secondes, et le mode référence exige une image ou une vidéo.
Faut-il choisir MiniMax H3 ou Seedance 2.5 ?
Utilisez MiniMax H3 pour des plans 2K compacts allant jusqu'à 15 secondes. Utilisez Seedance 2.5 pour des scènes allant jusqu'à 30 secondes, un ensemble de références bien plus large ou des retouches localisées. Choisissez selon le livrable.
Créer un plan guidé par une référence
Décrivez le plan cible en une phrase, choisissez un clip au mouvement lisible et donnez-lui une seule fonction. Ouvrez MiniMax H3 sur SeedVideo AI, vérifiez les contrôles et le tarif en crédits, puis générez la plus petite version capable de répondre à votre question créative principale.



