← Retour au blog

Pourquoi ma vidéo IA se déforme-t-elle ? Le problème de la durée

La déformation augmente généralement avec la durée du clip et le nombre d'objets. La cause probable, l'ancrage que chaque modèle accepte, comment tester votre propre plan et les plans où elle est difficile à éviter.

La déformation (le morphing), c'est quand un objet de votre clip devient peu à peu autre chose : une main fusionne avec une tasse, un pied de chaise se soude à la table, un visage change d'identité en plein plan. C'est l'un des défauts les plus courants de la vidéo générée, et sa cause probable indique des moyens concrets de le réduire.

En bref

Pourquoi cela arrive

Un modèle vidéo génère une suite d'images cohérentes localement : chaque image suit la précédente de façon plausible. La raison probable de la déformation, c'est que rien dans ce processus ne fonctionne comme un registre interne qui dirait « ceci est une tasse en céramique, elle a ces propriétés, elle persiste ». Nous ne pouvons pas voir l'intérieur des modèles : prenez donc cela comme l'explication qui correspond le mieux au défaut, pas comme un mécanisme documenté.

Vu ainsi, sur un nombre suffisant d'images, l'idée que le modèle se fait d'un objet peut dériver, et il dessine quelque chose de plausible mais de différent. La dérive est progressive, c'est pourquoi elle se lit comme une déformation et non comme un saut.

Cela expliquerait aussi pourquoi le même plan peut être propre à 5 secondes et cassé à 15.

Ce qui la réduit généralement

Des clips plus courts. Le levier que vous contrôlez le plus directement. Si un plan se déforme à 10 secondes, générez-le à 5 et coupez. Sur les modèles facturés à la durée, deux clips de 5 secondes coûtent à peu près autant qu'un clip de 10 (Kling v3 Standard avec son : 86 crédits pour 5 secondes, 171 pour 10), et chacun laisse moins de temps à la dérive pour s'accumuler.

Moins d'objets. Chaque élément dans le cadre est un élément de plus qui peut dériver. Un seul sujet sur un fond uni laisse au modèle le moins de choses à suivre.

Moins de mouvement. Un mouvement rapide aggrave généralement la déformation, sans doute parce que chaque image diffère davantage de la précédente.

Une première image de référence. Passer de l'image à la vidéo à partir d'une image fixe que vous avez validée fixe le point de départ : le modèle part de votre design et non de sa propre supposition. Sur Wan 3.0, c'est une image de départ, à partir de 24 crédits pour 5 secondes en 480p.

Un ancrage plus fort. Nous n'avons pas mesuré quel modèle se déforme le moins, et cela change d'un plan à l'autre : méfiez-vous donc de tout classement (cette page en avait un). Ce qui diffère vraiment entre les modèles, et se vérifie, c'est ce que vous pouvez donner au modèle comme base de travail. Prix sur 8frame ; un crédit coûte environ 0,01 dollar en pack :

Modèle Clip Crédits Durées sur 8frame Avec quoi l'ancrer
Wan 3.0 en 480p 5 s 24 de 2 à 30 s du texte, ou une image de départ ; pas d'images de référence sur le canvas
Veo 3.1 Lite 8 s sans son 33 4, 6 ou 8 s à partir de texte ; 8 s avec une image de départ une image de départ, plus une image de fin si vous le souhaitez ; pas d'images de référence
Kling v3 Standard 5 s sans son 57 de 3 à 15 s une image de départ, obligatoire ; pas d'images de référence
Seedance 2.5 5 s en 720p 157 de 4 à 30 s une image de départ et une image de fin, ou jusqu'à 9 images de référence (pas les deux) ; une vidéo de référence, une piste audio
Veo 3.1 Standard 8 s avec audio 448 4, 6 ou 8 s à partir de texte ; 8 s avec une image de départ une image de départ et une image de fin, ou de 1 à 3 images de référence avec l'option multi-référence (8 s uniquement)

Lisez la dernière colonne comme un choix d'ancrage, pas comme une note de qualité. Une image de départ fixe la façon dont le plan commence ; les images de référence montrent au modèle le sujet lui-même, qui est justement ce qui dérive quand un clip se déforme. Sur le canvas, les images de référence vont dans Seedance (jusqu'à 9), le mode référence de Grok Imagine (de 1 à 10, à partir de 35 crédits pour 5 secondes en 480p), Happy Horse (de 1 à 9), Gemini Omni Flash (de 1 à 7), Kling O1 Reference (jusqu'à 7) et Veo 3.1 en multi-référence (de 1 à 3). Sur Seedance, Gemini Omni Flash et Happy Horse, une image de départ et des références ne se combinent pas : si vous joignez les deux, l'image de départ est abandonnée. Toutes les limites sont dans limites d'images de référence par modèle.

Caméra fixe. Le mouvement de caméra ajoute généralement à la déformation, sans doute parce que le modèle invente la parallaxe en même temps.

Comment tester la déformation sur votre propre plan

Aucun classement, le nôtre compris, ne vous dit comment se comporte votre sujet. Une courte comparaison côte à côte, si :

  1. Figez les entrées. Une image de départ validée, un prompt, un format. Ne changez rien d'autre que le modèle.
  2. Lancez-le à 5 secondes sur deux ou trois modèles. À partir de la même image de départ : Wan 3.0 en 480p (24), Kling v3 Standard sans son (57) et Seedance 2.5 en 480p (70) font 151 crédits, environ 1,51 dollar, pour trois versions. Veo avec une image de départ est fixé à 8 secondes ; Veo 3.1 Lite sans son coûte 33.
  3. Parcourez-le image par image. Notez la seconde où l'objet change pour la première fois. Regardez d'abord là où deux objets se touchent, les mains, et tout ce qui passe derrière autre chose.
  4. Prolongez la version restée cohérente. Relancez-la à 10 secondes avant de vous engager sur une prise longue : une prise propre à 5 secondes ne garantit pas une prise propre à 10.
  5. Si le sujet a besoin de références, testez-les de la même façon. Les mêmes images de référence dans chaque modèle qui accepte des références, même prompt, même durée. Un visage en gros plan comme référence peut déclencher le filtre de Seedance ; voir Seedance "flagged as sensitive" (signalé comme sensible, E005).

Les plans qui se déforment généralement malgré tout

Les repérer tôt fait économiser des crédits : un clip qui aboutit est facturé même s'il se déforme, donc chaque nouvelle tentative d'un tel plan coûte de nouveau le prix complet.

Deux personnes en interaction. Les corps peuvent se traverser, et les deux identités peuvent dériver.

Des mains qui font quelque chose de précis. Une articulation extrême et des doigts qui se cachent sans cesse les uns les autres. Voir quel modèle d'IA gère le mieux les mains.

Une foule. Beaucoup de visages, chacun pouvant dériver de son côté.

Une caméra qui traverse une architecture. Le modèle doit inventer une structure 3D qu'il n'a pas, si bien que les lignes droites peuvent se courber et les surfaces se tordre.

Les plans longs d'un personnage récurrent. Sans images de référence, l'identité d'un personnage dérive généralement au fil d'une séquence, et même avec elles elle peut changer sous de nouveaux angles.

Tout ce qui dépasse environ 10 secondes avec un sujet dedans. L'exception, ce sont les contenus abstraits ou de texture : sans identité de sujet à garder cohérente, la durée compte généralement moins.

L'exception des clips longs

Bon à savoir, parce qu'elle inverse la règle : Wan 3.0 génère jusqu'à 30 secondes en une seule passe, 142 crédits en 480p avec le modèle de base. Cette durée convient mieux aux contenus abstraits et aux textures, où aucun objet n'a d'identité susceptible de dériver.

Fumée, eau, feuillage, lumière, particules en suspension, dégradés. Un plan de fond de 30 secondes de l'un de ces éléments n'a pas d'identité à perdre. Un plan de 30 secondes d'une personne a un visage et des mains à perdre.

La méthode qui l'évite

  1. Ébauchez le plan à 5 secondes sur Wan 3.0 en 480p, 24 crédits. Voyez s'il se déforme sur une durée courte.
  2. S'il se déforme à 5 secondes, la composition est sans doute trop complexe. Simplifiez : moins d'objets, moins de mouvement, caméra fixe.
  3. S'il est propre à 5 et casse à 10, générez à 5 et coupez. Ne luttez pas.
  4. Si le plan exige qu'un objet persiste pendant un vrai mouvement, donnez au modèle davantage de matière : faites le test ci-dessus avec des images de référence de l'objet sur un modèle qui accepte des références (Seedance 2.5 en accepte jusqu'à 9, 157 crédits pour 5 secondes en 720p) et gardez la version qui reste cohérente sur votre plan.
  5. Si c'est l'un des plans de la liste ci-dessus, changez de plan.

Il n'y a ni upscaler vidéo ni étape de réparation dédiée sur ce canvas : traitez donc un clip qui se déforme comme un clip à régénérer, pas à réparer. La décision se prend avant de lancer la génération.

Questions fréquentes

Pourquoi ma vidéo IA change-t-elle les objets en cours de route ? Le plus probable, c'est que le modèle ne garde pas de représentation persistante de l'objet, si bien que son idée de ce qu'est la chose dérive d'une image à l'autre.

Un clip plus long se déforme-t-il davantage ? En général, oui : plus le clip est long, plus la dérive a d'images pour s'accumuler. La durée est aussi le levier que vous contrôlez le plus directement.

Quel modèle se déforme le moins ? Nous ne l'avons pas mesuré, et cela dépend du plan : testez-le donc, avec la même image de départ et le même prompt à 5 secondes sur deux ou trois modèles, comparés image par image. Ce que vous pouvez comparer avant de dépenser quoi que ce soit, c'est l'ancrage que chaque modèle accepte : Seedance 2.5 accepte jusqu'à 9 images de référence, Veo 3.1 en multi-référence de 1 à 3, et Kling v3 et Wan 3.0 une image de départ et aucune image de référence sur le canvas.

Pourquoi mon clip abstrait de 30 secondes est-il réussi ? Le plus probable, c'est qu'il n'y a aucune identité d'objet qui puisse dériver. Les contenus abstraits supportent généralement mieux la durée qu'un sujet.

Sources


Des clips plus courts, moins d'objets, et coupez les plans qui continuent de se déformer.

Essayez sans inscription : vous arrivez directement sur un vrai tableau. Le canvas de 8frame est gratuit et illimité ; la génération est payante à partir de 19 dollars par mois.

Articles liés

guideComment utiliser Kling v3 Pro : quand les 114 crédits sont rentablesguideSeedance « flagged as sensitive » (E005) : pourquoi les photos avec un visage échouentguidePeut-on créer des vidéos IA sur son téléphone ? Ce qui marche dans un navigateur mobile en 2026

Make it
move.

Stay in the loop

Be the first to hear about our launch and get product updates