Pour garder le même personnage d'un clip vidéo IA à l'autre, la réponse n'est pas un modèle mais un ordre de travail : fixez d'abord le personnage dans une image fixe, puis générez chaque clip à partir de cette image. Sur 8frame, la version la moins chère, c'est Seedream 5 Lite à 6 crédits pour le portrait et Kling 2.6 Pro à 47 crédits pour un clip de 5 secondes sans son. Un personnage fixé coûte environ 53 crédits, contre les 282 que vous dépenseriez en relançant six fois du texte vers vidéo en espérant que les visages concordent.
En bref
- Ne réglez pas la cohérence dans le modèle vidéo. Réglez-la dans l'image, puis animez l'image.
- Fixation la moins chère : Seedream 5 Lite à 6 crédits (Seedream accepte jusqu'à 14 images de référence). Nano Banana 2, de 8 à 22 crédits selon la résolution, est l'autre bonne option.
- Vidéo avec références, du moins cher au plus cher : Kling O1 Reference à 73 crédits pour 5 secondes (jusqu'à 7 références), Seedance 2.5 à 157 (son inclus, jusqu'à 30 secondes), Veo 3.1 en mode référence à 448 (jusqu'à 3 références, 8 secondes).
- Seedance refuse les références avec le visage en gros plan. Donnez-lui des plans à partir de la taille ou en pied.
- Rien de tout cela n'est parfait : attendez-vous à des dérives de profil, sur les prises longues et quand deux visages conditionnés partagent le cadre.
Pourquoi le texte vers vidéo ne garde pas un personnage
Le texte vers vidéo génère un nouveau visage à chaque exécution. Même prompt, même modèle, deux personnes différentes. Pour un clip isolé, peu importe ; dès que deux clips sont montés ensemble, c'est un problème de production. Un prompt est une description, et une description a beaucoup de réponses valides. Une image de référence, elle, est une contrainte : le modèle doit respecter les pixels que vous lui donnez.
Relancer du texte vers vidéo jusqu'à ce qu'un visage plaise coûte 47 crédits par essai sans son sur Kling 2.6 Pro. Six essais font 282 crédits, environ 2,82 dollars au prix des packs, et vous finissez avec un visage impossible à reproduire au plan deux. Fixer l'image d'abord coûte 6 crédits.
Étape 1 : fixer le personnage dans une image
Seedream 5 Lite, 6 crédits. Seedream accepte jusqu'à 14 images de référence à la fois, plus que tout autre modèle d'image du canvas. Une fois le visage obtenu, vous pouvez le redonner avec une référence de costume, une de lumière et une de lieu.
Nano Banana 2, de 8 à 22 crédits. Prix selon la résolution, jusqu'à 4 images par exécution et jusqu'à 10 références. Utilisez-le quand le personnage doit tenir un grand recadrage.
Écrivez le prompt autour de ce qui doit rester fixe : âge, silhouette, cheveux, couleur des yeux, teint, un trait distinctif et la tenue avec une couleur nommée. L'ambiance peut changer à chaque plan ; la structure, non.
Étape 2 : construire un pack d'angles
Un seul portrait de face ne suffit pas. Générez le même personnage sous trois à cinq angles : de face, de trois quarts, de profil, depuis une caméra légèrement surélevée et un plan à partir de la taille ou en pied, le cadrage que Seedance accepte. Avec Seedream 5 Lite, cinq images coûtent 30 crédits.
ShotGrid aide ici : pour 42 crédits, il génère une planche 3x3 de neuf images à partir de 1 à 10 références, et vous voyez le personnage dans neuf moments avant de dépenser un crédit vidéo.
Étape 3 : générer la vidéo à partir de l'image
Image vers vidéo depuis l'image fixée. Kling 2.6 Pro à 47 crédits pour 5 secondes sans son (95 avec son) est le choix par défaut. Comme le visage est déjà juste dans la première image, l'essentiel du problème est réglé. Comparatif par modèle dans les meilleures IA image vers vidéo.
Modèles vidéo avec références :
- Kling O1 Reference, 73 crédits pour 5 secondes, 146 pour 10. Génère le clip à partir de jusqu'à 7 images de référence. (Kling O1 Video, 109 crédits pour 5 secondes, est un autre mode : il modifie une vidéo que vous importez.)
- Seedance 2.5, 157 crédits pour 5 secondes en 720p. Jusqu'à 30 secondes, son activé par défaut au même prix, jusqu'à 9 références sur le canvas. Utilisez des références à partir de la taille ou en pied, pas des gros plans du visage : le filtre de Seedance refuse les visages en gros plan avec une erreur E005 dans tous nos tests, alors que la même personne cadrée à partir de la taille passe et garde son identité. Plus de détails dans Seedance flagged as sensitive (E005), en anglais.
- Veo 3.1 en mode référence, 448 crédits. Jusqu'à 3 références, 8 secondes. Utile pour un plan principal, pas pour les onze autour.
Une séquence de six plans : 30 crédits pour le pack de références plus six clips Kling 2.6 Pro sans son à 47 chacun font 312 crédits, environ 3,12 dollars. Avec les 1 000 crédits du forfait Starter à 19 dollars, reportés tant que vous restez abonné, cela fait trois séquences par mois.
Tableau comparatif
| Outil | Étape | Crédits | Ce qu'il fixe |
|---|---|---|---|
| Seedream 5 Lite | Image | 6 | Jusqu'à 14 références |
| Nano Banana 2 | Image | 8 à 22 | Jusqu'à 10 références |
| ShotGrid | Storyboard | 42 | Neuf images à partir de 1 à 10 références |
| Kling 2.6 Pro | Image vers vidéo | 47 sans son, 95 avec son | Identité de la première image |
| Kling O1 Reference | Vidéo | 73 (5 s) | Jusqu'à 7 références |
| Seedance 2.5 | Vidéo | 157 (5 s, 720p) | Jusqu'à 9 références, pas de gros plans de visage ; jusqu'à 30 s ; son |
| Veo 3.1 mode référence | Vidéo | 448 (8 s) | Jusqu'à 3 références |
Ce qui échoue encore
- Prises longues. Plus un clip continu dure, plus le visage a de marge pour dériver. Prévoyez des coupes.
- Profils. Les références de face se transfèrent mal à un profil à 90 degrés. Ajoutez une référence de profil.
- Deux visages conditionnés dans un même plan. Plus difficile qu'un seul. Générez des plans individuels et alternez.
- Costume. La référence fixe le visage plus que les vêtements. Nommez la couleur dans chaque prompt.
- Gros plans sur Seedance. Refusés avec E005. Les crédits reviennent automatiquement, mais relancer la même image n'aide pas : changez le cadrage.
Deux remarques pour les lecteurs francophones : les prix de 8frame sont en dollars américains, et l'interface de l'application existe en français. Si votre navigateur est réglé en français, l'application s'ouvre en français.
Questions fréquentes
Comment garder le même personnage dans plusieurs vidéos IA ? Générez une image canonique du personnage, construisez un pack de trois à cinq angles plus un plan à partir de la taille, et utilisez-le comme référence pour chaque clip. Sur 8frame : Seedream 5 Lite à 6 crédits par image, puis image vers vidéo avec Kling 2.6 Pro (47 sans son) ou Kling O1 Reference (73).
Quel modèle vidéo IA est le meilleur pour des personnages cohérents ? Pour le volume, image vers vidéo depuis une image fixée avec Kling 2.6 Pro, ou Kling O1 Reference avec jusqu'à 7 références. Pour les prises longues avec son, Seedance 2.5 avec des références à partir de la taille ou en pied. Pour un plan principal, Veo 3.1 en mode référence.
Pourquoi Seedance refuse-t-il ma référence de personnage ? Son filtre refuse les images de référence avec le visage en gros plan, avec une erreur E005. Un plan du même personnage à partir de la taille ou en pied passe.
La cohérence des personnages est-elle résolue en 2026 ? Non. C'est suffisant pour la production si vous partez de l'image et coupez souvent, mais il reste des dérives de profil, sur les prises longues et avec deux personnages dans le cadre.
L'image d'abord, la vidéo ensuite, le tout sur un canvas. Le canvas de 8frame est gratuit et illimité ; la génération est payante à partir de 19 dollars par mois.