Tutoriel : lier un personnage dans Kling 3.0
Kling 3.0 n’accepte pas de référence de personnage. Si vous essayez d’y lier un personnage et obtenez un visage différent à chaque fois, voilà pourquoi.
En bref
Kling 3.0 prend uniquement en charge le texte en vidéo et l’image en vidéo : il ne peut donc pas lier un personnage à une image de référence. Kling 3.0 Motion Control le peut, et se situe à un niveau inférieur. Il prend une image du personnage et une vidéo de mouvement d’au moins trois secondes, ainsi qu’une option character_orientation. Pour conserver un personnage sur des plans séparés, utilisez l’un des treize modèles de référence en vidéo. Il n’existe nulle part de force de référence, de force de mouvement ni de mesure de dérive.
Kling 3.0 n’accepte pas de référence de personnage.
Ses capacités se limitent au texte en vidéo et à l’image en vidéo. C’est tout. Si vous essayez de lier un personnage à Kling 3.0 avec une image de référence et obtenez un visage différent à chaque fois, voilà pourquoi, et aucun réglage n’y changera rien.
Le modèle qu’il vous faut est Kling 3.0 Motion Control, une entrée distincte du catalogue avec des capacités différentes. Ou l’un des onze autres modèles qui acceptent une référence.
La famille Kling, et ce que fait chaque modèle
Huit modèles Kling sont disponibles, et la distinction qui compte n’est pas le numéro de version :
| Modèle | Niveau | Accepte une référence ? |
|---|---|---|
| Kling 3.0 | ULTRA | Non |
| Kling 3.0 Turbo | PREMIUM | Non |
| Kling 3.0 Motion Control | PREMIUM | Oui |
| Kling 2.1 Master | ULTRA | Non |
| Kling 2.0 Master | ULTRA | Non |
| Kling 1.6 Pro | PREMIUM | Non |
| Kling 1.5 Pro | PREMIUM | Non |
| Kling 1.0 Standard | STANDARD | Non |
Notez que le modèle compatible avec les références se situe à un niveau inférieur à Kling 3.0. Le travail sur les personnages n’est pas une version premium du texte en vidéo ; c’est une tâche différente, qui tourne sur un modèle différent.
Ce que fait réellement Motion Control
Ce n’est pas un curseur de force appliqué à une référence. Il prend deux fichiers.
Une image du personnage : un JPG ou PNG, jusqu’à 10MB. Qui apparaît à l’écran.
Une vidéo de mouvement : un MP4 ou MOV, d’au moins trois secondes, jusqu’à 100MB. Le mouvement que le personnage exécute.
S’y ajoute une option character_orientation qui décide quel cadrage l’emporte, celui de l’image ou celui de la vidéo. La résolution est de 720p ou 1080p, et le prompt sert d’indication facultative sur la scène.
Le mouvement est donc fourni plutôt que décrit. Si vous disposez d’un clip du mouvement souhaité, c’est une instruction bien plus forte que n’importe quelle phrase, et bien plus forte qu’un nombre.
Commencez sur Motion Control.
Si vous voulez un personnage sur des plans séparés
Motion Control produit une seule performance. Pour un personnage présent dans plusieurs plans indépendants, il vous faut la référence en vidéo, prise en charge par treize modèles : Seedance 2.0, 2.0 Fast et 2.5, Veo 3.1 et 3.1 Lite, Wan 2.7, 3.0 et 3.0 Prime, Kling 3.0 Motion Control, MiniMax H3, Gemini Omni Flash et les deux modèles Happy Horse.
Rendez-vous sur référence en vidéo et fournissez l’image du personnage à chaque génération.
Pour une séquence continue plutôt que des plans séparés, le Long Video Generator enchaîne les segments : chacun reprend le clip terminé du précédent et continue à partir de sa dernière image, les références de personnage étant conservées tout du long. C’est le mécanisme de continuité le plus solide disponible, et c’est désormais vers lui que pointe Smart Shot.
Pour des scènes distinctes qui passent d’un lieu à l’autre, le Series Generator est l’outil adapté.
Les réglages qui n’existent pas
Disons-le clairement, car c’est sur ce sujet que les inventions prolifèrent.
Pas de force de référence. Ni 0.35, ni 0.65, ni 0.85. Aucun modèle n’expose de valeur qui dose le respect d’une référence.
Pas de force de mouvement. Sur les 37 modèles de génération vidéo, les paramètres sont le prompt, la durée, le format d’image et la résolution, plus des références, un prompt négatif ou des images de début et de fin sur certains modèles.
Pas de masques par zone. Veo 3.1 n’en a pas, et aucun autre modèle ici non plus.
Pas de mesure de dérive. Il n’existe ni indicateur de dérive du visage en pixels, ni test de cohérence sur 192 images, ni chiffre publié permettant de comparer les modèles. Les tableaux qui les citent les ont inventés.
Un modèle expose bien une seed : Wan 2.7, qui accepte aussi un prompt négatif et une option d’extension du prompt. C’est l’exception, et il vaut la peine de le connaître justement parce que c’est le seul.
Garder un personnage stable, en pratique
Faute de curseur, les leviers sont l’image de référence et le prompt.
Utilisez une bonne référence. De face ou de trois quarts, bien éclairée, avec un visage assez grand dans le cadre pour conserver les détails. Tout découle de cette image : une référence floue ou maladroite se répercute sur chaque plan.
Réutilisez le même fichier. Pas une image similaire, la même. Des références différentes produisent des personnes différentes, ce qui est précisément le problème que vous cherchez à résoudre.
Gardez la structure du prompt constante. Changez l’action, mais conservez à l’identique la description du personnage et l’éclairage. La réécrire invite le modèle à la réinterpréter.
Générez court. L’identité tient sur quelques secondes et dérive sur une longue durée. Plusieurs clips courts valent mieux qu’un long, et leurs échecs coûtent moins cher.
Vérifiez la dernière image, en particulier pour les travaux enchaînés, puisque le segment suivant repart de celle-ci.
Choisir entre les modèles Kling
Pour du simple texte en vidéo ou l’animation d’une image fixe, Kling 3.0 en ULTRA, ou Kling 3.0 Turbo en PREMIUM pendant la phase d’exploration. Les anciennes entrées Master et Pro restent disponibles et coûtent moins cher.
Pour tout ce qui implique un personnage précis, Kling 3.0 Motion Control, ou l’un des treize modèles de référence en vidéo.
Une comparaison plus large se trouve sur la page des alternatives à Kling, et le catalogue complet sur Modèles. Chaque génération fait l’objet d’un devis avant son lancement, et les prix des packs figurent sur la page des tarifs.
Questions fréquentes
Kling 3.0 peut-il utiliser une image de référence de personnage ?▾
Non. Kling 3.0 prend uniquement en charge le texte en vidéo et l’image en vidéo. Kling 3.0 Motion Control est l’entrée qui accepte une référence, et elle se situe à un niveau inférieur à Kling 3.0 : le travail sur les personnages est donc une tâche différente, pas une option premium.
Quelle force de référence régler sur Kling ?▾
Aucun modèle ne propose de réglage de force de référence. Des valeurs comme 0.35, 0.65 ou 0.85 apparaissent dans certains guides, mais aucun modèle n’expose de paramètre qui dose le respect d’une référence. Les vrais leviers sont la qualité de l’image de référence et le prompt.
De quoi Kling 3.0 Motion Control a-t-il besoin ?▾
Deux fichiers : une image du personnage en JPG ou PNG jusqu’à 10MB, et une vidéo de mouvement en MP4 ou MOV d’au moins trois secondes et jusqu’à 100MB. Il dispose aussi d’une option character_orientation qui décide si le cadrage vient de l’image ou de la vidéo, d’un choix de résolution et d’un prompt facultatif.
Comment conserver un personnage sur plusieurs plans séparés ?▾
Utilisez la référence en vidéo, prise en charge par treize modèles : Seedance 2.0, 2.0 Fast et 2.5, Veo 3.1 et 3.1 Lite, Wan 2.7, 3.0 et 3.0 Prime, Kling 3.0 Motion Control, MiniMax H3, Gemini Omni Flash et les deux modèles Happy Horse. Motion Control produit une seule performance, pas une série.
Quel modèle Kling choisir ?▾
Kling 3.0 en ULTRA ou Kling 3.0 Turbo en PREMIUM pour le texte en vidéo et l’animation d’images fixes, les anciennes entrées Master et Pro étant moins chères. Kling 3.0 Motion Control pour tout ce qui implique un personnage précis.
Existe-t-il un moyen de mesurer la dérive du visage entre modèles ?▾
Non. Il n’existe ni indicateur de dérive, ni test de cohérence, ni chiffre publié pour classer les modèles. Les tableaux comparatifs qui citent une dérive du visage en pixels ou des scores de cohérence à deux décimales ont inventé ces chiffres.
Un modèle expose-t-il une seed ?▾
Un seul : Wan 2.7, qui accepte aussi un prompt négatif et une option d’extension du prompt. C’est l’exception parmi les 37 modèles de génération vidéo, ce qu’il est bon de savoir lorsque vous avez besoin de résultats reproductibles.
