Les visages déformés dans les vidéos IA font partie des problèmes les plus fréquents avec les générateurs vidéo comme Runway, Kling, Veo, Sora, Luma, Pika, Seedance ou Artlist AI. Une image peut être très belle au départ, puis la vidéo générée peut afficher des yeux instables, une bouche étrange, un visage qui change, une mâchoire déformée ou une identité qui disparaît après quelques secondes.
Ce problème arrive surtout quand le mouvement est trop fort, quand l’image source est floue, quand le visage est trop petit, quand la tête tourne beaucoup, quand plusieurs personnes sont dans l’image ou quand le prompt ne précise pas assez ce qui doit rester stable.
Dans ce guide, nous allons voir comment éviter les visages déformés dans les vidéos IA : choix de l’image source, prompt, mouvements à éviter, durée idéale, réglages, exemples de prompts négatifs et méthode de vérification avant publication.
À retenir : pour éviter les visages déformés, utilisez une image nette, un visage bien visible, un mouvement léger, une vidéo courte de 4 à 5 secondes, un prompt qui demande de préserver l’identité, et des consignes négatives comme “no face distortion”, “no morphing”, “no mouth distortion”, “no eye distortion”.
Pourquoi les visages se déforment dans les vidéos IA ?
Les générateurs vidéo IA doivent inventer les images qui viennent après l’image de départ. Quand un visage bouge, tourne, parle ou change d’expression, le modèle doit maintenir la même identité image après image. C’est difficile, surtout si le visage est petit, partiellement caché, mal éclairé ou soumis à un mouvement trop complexe.
La déformation peut aussi venir d’un prompt trop vague. Si vous écrivez seulement “anime cette photo”, l’IA peut décider elle-même comment le visage doit bouger. Elle peut alors modifier les traits, lisser le visage, changer la bouche ou créer une expression qui ne correspond plus à la photo originale.
Une tête qui tourne, une bouche qui parle, une danse ou un geste rapide augmente le risque de visage instable.
Si le visage est flou, sombre ou trop petit, l’IA invente des détails et peut changer l’identité.
Sans consigne précise, l’IA ne sait pas quels traits du visage doivent rester identiques.
Plus la vidéo dure longtemps, plus le visage peut dériver, surtout sur les plans de 10 secondes ou plus.
Méthode rapide pour éviter les visages déformés
| Problème | Cause probable | Solution |
|---|---|---|
| Visage qui change | Identité mal protégée dans le prompt | Ajouter “keep the same face, identity, facial features”. |
| Bouche déformée | Parole ou expression trop forte | Demander “subtle smile” ou “closed mouth”, éviter le dialogue si le modèle n’est pas adapté. |
| Yeux étranges | Mouvement de tête ou regard trop complexe | Demander “natural eye movement, stable eyes, no eye distortion”. |
| Visage qui fond | Vidéo trop longue ou mouvement excessif | Générer 4 à 5 secondes avec mouvement léger. |
| Plusieurs visages identiques | Groupe difficile à stabiliser | Demander “keep each person’s unique face” et éviter les gros mouvements. |
| Visage trop lissé | IA qui réinterprète l’image | Ajouter “preserve natural skin texture, no beautification, no face smoothing”. |
1. Utiliser une image source nette
La qualité de l’image de départ est essentielle. Si le visage est flou, trop petit, sombre, caché par des lunettes, coupé par le cadrage ou très incliné, l’IA aura plus de mal à conserver l’identité. Elle va alors inventer des détails, ce qui peut provoquer un visage différent dans la vidéo.
Pour une vidéo IA stable, choisissez une image où le visage est bien éclairé, assez grand, net, visible de face ou légèrement de profil. Plus la photo est propre, plus l’IA a de repères pour garder les traits du visage.
- Préférez : visage net, bien éclairé, visible, sans flou de mouvement.
- Évitez : visage trop petit, sombre, coupé, masqué ou fortement incliné.
- Pour un groupe : chaque visage doit être suffisamment visible.
- Pour une photo IA : corrigez les défauts avant de l’animer.
- Pour une vieille photo : améliorez la netteté avant de générer la vidéo.
2. Demander un mouvement léger
Plus le mouvement est fort, plus le risque de déformation augmente. Une tête qui tourne à 90 degrés, une personne qui parle beaucoup, une danse rapide ou un changement d’expression extrême peut faire perdre la stabilité du visage.
Pour garder un visage naturel, demandez plutôt un mouvement doux : léger sourire, respiration subtile, petit mouvement de tête, caméra qui avance lentement, arrière-plan vivant ou mouvement léger des cheveux. L’objectif est de donner vie à l’image sans forcer l’IA à reconstruire tout le visage.
- Bon mouvement : subtle head movement, gentle smile, natural breathing.
- Bon mouvement caméra : slow camera push-in, slight handheld motion, gentle pan.
- À éviter : strong head turn, exaggerated facial expression, fast dancing.
- À éviter : parler si le modèle ne gère pas bien le lip-sync.
- Meilleure durée : 4 à 5 secondes pour commencer.
3. Protéger l’identité dans le prompt
Le prompt doit préciser clairement que le visage, l’identité et les traits doivent rester identiques. Il ne faut pas seulement demander “animate the image”. Il faut expliquer ce qui doit être préservé : visage, yeux, bouche, nez, mâchoire, peau, coiffure, tenue, proportions et composition.
Cette partie du prompt est particulièrement importante en image-to-video. L’IA doit comprendre que son rôle n’est pas de recréer une nouvelle personne, mais d’animer la personne déjà présente dans l’image.
Phrase utile : Keep the same face, identity, facial features, eyes, mouth, hairstyle, skin texture, outfit, body proportions, colors and composition. Preserve the original person exactly.
4. Ajouter des prompts négatifs
Les prompts négatifs servent à dire ce qu’il ne faut pas faire. Ils ne garantissent pas un résultat parfait, mais ils aident à limiter les défauts fréquents. Pour les visages, les mots les plus utiles concernent la déformation, les yeux, la bouche, le morphing et le changement d’identité.
| Prompt négatif | Utilité |
|---|---|
| No face distortion | Réduire les visages tordus, asymétriques ou instables. |
| No identity change | Limiter les changements de personne pendant la vidéo. |
| No morphing | Éviter que le visage fonde ou se transforme progressivement. |
| No eye distortion | Réduire les yeux étranges, mal alignés ou instables. |
| No mouth distortion | Limiter les bouches déformées, dents étranges ou lèvres instables. |
| No face smoothing | Éviter un visage trop lissé ou artificiel. |
| No beautification | Préserver le visage réel sans transformation esthétique non demandée. |
| No extra people | Éviter l’ajout de personnes ou de visages parasites. |
5. Éviter les gros plans trop proches
Un très gros plan du visage peut révéler le moindre défaut : yeux asymétriques, bouche instable, peau trop lissée, dents étranges ou changement d’expression. Pour une première génération, il est souvent plus sûr de choisir un plan poitrine ou plan moyen qu’un gros plan extrême.
Un plan un peu plus large laisse de la place au mouvement de caméra, aux épaules, aux vêtements et à l’arrière-plan. La vidéo paraît plus naturelle et les petites imperfections du visage sont moins visibles.
- Plus stable : plan poitrine, plan américain, plan moyen.
- Plus risqué : très gros plan sur yeux, bouche ou visage.
- Pour un portrait : demandez un mouvement très léger.
- Pour un clip musical : alternez plans larges et plans visage.
- Pour une publicité : évitez de faire parler un visage si ce n’est pas indispensable.
6. Limiter la durée de la génération
Une vidéo IA courte est généralement plus stable qu’une vidéo longue. Plus la vidéo dure, plus le modèle doit maintenir le visage dans le temps. Après plusieurs secondes, les traits peuvent dériver : le visage change, la bouche devient étrange, les yeux se déplacent ou la peau se transforme.
Pour commencer, une durée de 4 à 5 secondes est souvent le meilleur compromis. Si vous avez besoin d’un clip plus long, il vaut mieux générer plusieurs plans courts et les assembler au montage plutôt que demander une seule longue vidéo.
- Test : 4 à 5 secondes.
- Clip musical : plusieurs plans de 5 secondes.
- Publicité : plans courts, bien contrôlés.
- Portrait : durée courte avec mouvement minimal.
- Vidéo longue : assembler plusieurs clips au montage.
7. Éviter les visages multiples si le modèle n’est pas stable
Les groupes sont plus difficiles à animer qu’un seul visage. Quand il y a plusieurs personnes, l’IA peut mélanger les traits, uniformiser les visages, changer les expressions ou rendre les personnes trop similaires. C’est fréquent dans les scènes de foule, supporters, familles, groupes d’amis ou clips musicaux.
Si vous devez animer un groupe, demandez un mouvement très léger et insistez sur le fait que chaque personne doit garder son visage unique. Évitez les chorégraphies, les rotations et les gestes rapides.
Phrase utile pour un groupe : Keep each person’s unique face, identity, hairstyle, outfit and body proportions. Do not make faces look similar. No face swapping, no duplicated faces, no identity blending.
8. Ne pas demander de dialogue si le modèle n’est pas fait pour ça
Faire parler un visage est l’une des tâches les plus difficiles. La bouche, les dents, la langue, les lèvres et l’expression doivent rester cohérentes avec le son. Si le modèle n’est pas spécialisé dans le dialogue ou le lip-sync, le visage peut vite devenir étrange.
Pour une vidéo parlée, utilisez plutôt un modèle adapté comme HappyHorse, HeyGen, D-ID ou un modèle vidéo qui gère correctement l’audio et la synchronisation labiale. Sinon, générez une vidéo sans parole, puis ajoutez voix, sous-titres ou texte en montage.
- Pour un portrait simple : sourire léger, respiration, petit mouvement de tête.
- Pour dialogue : utiliser un modèle spécialisé lip-sync.
- À éviter : demander une longue phrase parlée à un modèle non spécialisé.
- Alternative : ajouter la voix off et les sous-titres après génération.
- Pour un clip musical : éviter le chant en gros plan si le modèle n’est pas fiable.
Prompt complet pour éviter les visages déformés
Voici un prompt générique à utiliser pour animer une photo avec un visage sans trop de déformation :
Prompt : Animate the uploaded image into a realistic 5-second cinematic video. Keep the same face, identity, facial features, eyes, mouth, hairstyle, skin texture, outfit, body proportions, colors and composition. Add only subtle natural movement, gentle breathing, slight head movement and a slow camera push-in. Preserve the original person exactly. No face distortion, no identity change, no morphing, no eye distortion, no mouth distortion, no face smoothing, no beautification, no extra people, no outfit change.
Prompt pour un portrait réaliste
Animate the uploaded portrait into a realistic 5-second cinematic video. Keep the same face, identity, facial features, skin texture, hairstyle, outfit and proportions. Add subtle breathing, slight natural head movement, gentle eye movement and soft background motion. The person should remain recognizable and unchanged. No face distortion, no mouth distortion, no eye distortion, no morphing, no identity change, no face smoothing.
Prompt pour un groupe de personnes
Create a realistic 5-second cinematic video from the uploaded group photo. Keep all people visible and recognizable. Preserve each person’s unique face, identity, hairstyle, outfit, body shape, proportions and position. Add only subtle natural movement, slight smiling, gentle cheering and soft background motion. Do not make faces look similar. No face distortion, no face swapping, no duplicated faces, no identity blending, no extra people, no hand distortion.
Prompt pour une photo de supporters
Create a realistic 5-second stadium celebration video from the uploaded image. Keep the same people, faces, identities, outfits, body shapes, proportions and group composition. Add subtle cheering, small natural arm movement, smiling, lively crowd in the background and a smooth cinematic camera push-in. No dancing choreography, no face distortion, no identity change, no hand distortion, no duplicated faces, no floating flags, no outfit change.
Prompt pour un clip musical avec visage
Create a realistic 5-second cinematic music video shot from the uploaded image. Keep the same person, face, identity, hairstyle, outfit, body proportions and composition. Add a subtle emotional expression, gentle head movement, soft cinematic lighting, slow camera push-in and music video atmosphere. Do not change the person’s face. No face distortion, no mouth distortion, no identity change, no morphing, no extra fingers, no random text.
Quels mots utiliser selon le défaut ?
| Défaut observé | Mots à ajouter au prompt |
|---|---|
| Le visage change | same face, same identity, preserve facial features, no identity change |
| Les yeux deviennent étranges | stable eyes, natural eye movement, no eye distortion, no cross-eye |
| La bouche se déforme | natural mouth, closed mouth, subtle smile, no mouth distortion |
| Le visage devient trop lisse | preserve natural skin texture, no face smoothing, no beautification |
| Le visage fond | no morphing, no melting, no identity blending, stable face |
| Les personnes se ressemblent | keep each person’s unique face, no duplicated faces, no face swapping |
| La tête tourne trop | slight head movement only, no strong head turn, face remains visible |
| Le sourire devient bizarre | subtle smile, natural expression, no exaggerated smile, no teeth distortion |
Quel outil choisir pour garder les visages stables ?
Aucun outil ne garantit une stabilité parfaite à chaque génération. Le résultat dépend du modèle, de la qualité de l’image, du mouvement demandé et de la durée. Cependant, certains outils sont plus adaptés selon l’usage.
| Usage | Outils conseillés | Conseil |
|---|---|---|
| Portrait animé réaliste | Kling, Runway, Luma, Veo | Mouvement léger, durée courte, visage bien visible. |
| Groupe de personnes | Runway, Kling, Veo | Insister sur chaque visage unique et éviter les mouvements forts. |
| Portrait parlant | HeyGen, D-ID, HappyHorse | Utiliser un modèle spécialisé dans le lip-sync. |
| Clip musical | Runway, Kling, Veo, Artlist AI | Créer plusieurs plans courts plutôt qu’une longue génération. |
| Photo de supporters | Kling, Runway, Veo | Demander cheering léger, pas de chorégraphie, pas de visage dupliqué. |
| Animation simple | CapCut, Canva, Adobe Express | Utiliser zoom, mouvement léger et texte ajouté après. |
Méthode simple pour générer une vidéo IA sans visage déformé
Choisissez une image nette. Le visage doit être visible, bien éclairé, assez grand et non coupé.
Commencez avec une vidéo courte. Générez d’abord 4 à 5 secondes pour tester la stabilité du visage.
Demandez un mouvement léger. Respiration, petit sourire, léger mouvement de tête, caméra douce.
Protégez l’identité. Ajoutez “same face, same identity, preserve facial features”.
Ajoutez des négatifs. No face distortion, no morphing, no eye distortion, no mouth distortion.
Évitez le dialogue inutile. Si le modèle ne gère pas le lip-sync, ajoutez la voix et les sous-titres après.
Générez plusieurs versions. Comparez les résultats et gardez celle où le visage reste le plus stable.
Vérifiez image par image. Regardez surtout les yeux, la bouche, les dents, la mâchoire et les transitions.
Checklist avant de publier une vidéo IA avec visage
- Le visage reste-t-il reconnaissable du début à la fin ?
- Les yeux sont-ils naturels et bien alignés ?
- La bouche reste-t-elle stable ?
- Les dents ne sont-elles pas déformées ?
- La peau n’est-elle pas trop lissée ?
- La personne ne change-t-elle pas d’identité ?
- Les cheveux et vêtements restent-ils cohérents ?
- Les autres visages du groupe restent-ils différents ?
- Le mouvement paraît-il naturel ?
- La vidéo reste-t-elle correcte sur smartphone ?
Les erreurs fréquentes à éviter
- Demander une forte rotation de tête. Le visage risque de changer ou de se déformer.
- Faire parler un visage avec un modèle non adapté. La bouche peut devenir étrange.
- Utiliser une image floue. L’IA invente les détails manquants.
- Générer une vidéo trop longue. L’identité peut dériver après quelques secondes.
- Oublier les prompts négatifs. Il faut préciser ce que l’IA doit éviter.
- Faire bouger plusieurs personnes en même temps. Les visages peuvent se mélanger.
- Demander une chorégraphie complexe. Les mains, visages et corps peuvent se déformer.
- Publier sans vérifier les yeux et la bouche. Ce sont les zones qui trahissent le plus les vidéos IA ratées.
Verdict : comment éviter les visages déformés dans les vidéos IA ?
Pour éviter les visages déformés dans les vidéos IA, il faut d’abord partir d’une image source propre. Le visage doit être net, bien éclairé et assez grand. Ensuite, il faut limiter le mouvement : une légère expression, un petit mouvement de tête et une caméra douce donnent souvent un meilleur résultat qu’une action complexe.
Le prompt doit demander explicitement de préserver l’identité : même visage, mêmes traits, mêmes yeux, même bouche, même coiffure, même tenue et mêmes proportions. Il faut aussi ajouter des prompts négatifs pour éviter les défauts les plus courants : face distortion, morphing, eye distortion, mouth distortion, identity change, face smoothing.
Recommandation simple : générez une vidéo courte de 4 à 5 secondes, avec mouvement léger, visage bien visible, prompt en anglais, identité protégée et consignes négatives. Si le visage reste instable, réduisez encore le mouvement ou choisissez un modèle plus adapté au portrait.
FAQ
Pourquoi les visages sont déformés dans les vidéos IA ?
Les visages se déforment souvent parce que l’image source est floue, le mouvement est trop fort, la vidéo est trop longue ou le prompt ne précise pas que l’identité doit rester identique.
Quel prompt utiliser pour éviter les visages déformés ?
Utilisez des phrases comme “keep the same face, same identity, preserve facial features” et ajoutez “no face distortion, no morphing, no eye distortion, no mouth distortion, no identity change”.
Quelle durée choisir pour garder un visage stable ?
Pour commencer, 4 à 5 secondes est le meilleur choix. Une vidéo courte limite le risque que le visage dérive ou change d’identité.
Pourquoi mon visage change dans Kling, Runway ou Veo ?
Le visage peut changer si le mouvement est trop complexe, si la photo est peu nette, si la tête tourne trop ou si le prompt ne protège pas assez l’identité. Réduisez le mouvement et ajoutez des consignes de stabilité.
Comment éviter les visages identiques dans une photo de groupe ?
Ajoutez une consigne comme “keep each person’s unique face and identity, no duplicated faces, no face swapping, no identity blending”. Évitez aussi les mouvements forts et les chorégraphies complexes.
Faut-il faire parler un visage avec une IA vidéo classique ?
Pas toujours. Si le modèle ne gère pas bien le lip-sync, la bouche peut se déformer. Pour une vidéo parlée, utilisez plutôt HeyGen, D-ID, HappyHorse ou un modèle spécialisé dans les portraits parlants.
Sources utiles
- Runway — Gen-4 Video Prompting Guide
- Runway — Image-to-Video Prompting Guide
- Kling AI — drift, consistency et identity warping
- Kling — guide image-to-video
- Google Cloud — guide de prompting pour Veo 3.1
- Google Cloud — Veo Video Generation Prompt Guide
- OpenAI — Sora 2 Prompting Guide
- Luma — générateur vidéo à partir d’image
- Artlist — AI Video Generator
À lire aussi sur Chargeur.org
- Comment écrire un bon prompt pour générer une vidéo IA ?
- Meilleurs outils IA pour créer un clip musical
- Meilleurs outils IA pour créer une vidéo à partir d’un texte sur Artlist
- Meilleurs outils IA pour transformer une image en vidéo
- Meilleurs outils IA pour animer une photo
- Sora, Veo ou Runway : quel générateur vidéo IA choisir ?
- Univers Tech
