Kling 2.6 Image to Video

Animez une photo avec le mouvement Kling, et faites-la parler.

5/10sAudio15-50 créditsImage en vidéo

Vision créative

Décrivez le mouvement. Avec le son activé, le dialogue entre guillemets est prononcé.

0/2500

Paramètres vidéo

Ajoute des voix et des effets sonores. Double le coût en crédits.

Coût de production
15
Solde de crédits
Chargement...

Aperçu cinéma

Prêt pour la production
Configurez vos paramètres et commencez à créer votre œuvre cinématographique

Historique des générations0 enregistrements

10 derniers enregistrements • Disponible pendant 7 jours

Générateur Kling 2.6 Image to Video

Importez une photo et Kling 2.6 l’anime — et, si vous le souhaitez, donne une voix à la personne représentée. Le modèle de Kuaishou de décembre 2025 génère la parole et l’image en une seule passe : une réplique écrite dans le prompt revient donc prononcée et synchronisée. Cinq ou dix secondes, à partir de 15 crédits.

Le clip conserve le format de votre image : recadrez la photo avant de l’importer, pas après

Kling 2.6

Pourquoi choisir Kling 2.6 Image to Video

La plupart des modèles d’image vers vidéo produisent du mouvement, mais restent silencieux. Kling 2.6 est le modèle de ce site où une photographie immobile peut finalement parler : l’audio est généré avec les images, ce qui permet de synchroniser la bouche et la voix.

Entrée

Une seule photo suffit

Importez un fichier JPEG ou PNG unique de 10 Mo maximum et décrivez le mouvement. L’image définit le sujet, l’éclairage et le cadrage ; le prompt n’a donc qu’à préciser ce qui change.

Audio

Donner une voix au sujet

Écrivez une réplique entre guillemets et indiquez le locuteur entre crochets : la personne de votre photo la prononcera avec des mouvements de lèvres synchronisés. Kuaishou a optimisé la version 2.6 pour les dialogues en anglais et en chinois.

Format

Votre image définit le cadre

Il n’y a pas de réglage du format d’image ici, et c’est volontaire : le clip reprend la forme de votre import. Une photo verticale prise au téléphone produit une vidéo verticale, sans recadrage ni bandes noires.

Maîtrise des coûts

Ne payer le son que lorsque vous en avez besoin

Cinq secondes sans son coûtent 15 crédits, et 25 avec audio. Dix secondes coûtent 25 sans son et 50 avec son. Les tests de mouvement utilisent le tarif le plus bas ; seule la prise finale inclut le coût de la voix.

Cohérence

Le visage reste le même

La cohérence du personnage d’un plan à l’autre faisait partie des objectifs annoncés par Kuaishou pour la version 2.6. Elle compte davantage ici qu’en texte vers vidéo : la référence est une personne réelle à laquelle vous pouvez comparer le résultat.

Facturation

Les générations échouées sont remboursées

Les crédits sont réservés lors de l’envoi et automatiquement restitués si la génération échoue ou si le fournisseur ne répond jamais, y compris lorsque la génération est refusée à cause d’une image d’entrée inutilisable.

Le même prix que texte vers vidéo

Ajouter une image ne coûte rien de plus. Un clip basé sur une photo et un clip créé uniquement avec un prompt, de même durée et avec le même réglage audio, sont facturés de façon identique.

15 à 50 crédits par clip
Étape par étape

Comment utiliser Kling 2.6 Image to Video

Deux éléments déterminent le résultat : la photo fournie et la façon dont vous formulez le mouvement. Le prompt ne décrit pas une scène à partir de zéro ; il décrit ce qui change dans une scène déjà existante.

1
Première étape

Importer un fichier JPEG ou PNG

Une image de 10 Mo maximum. Le format WebP n’est pas accepté par ce point d’accès : convertissez-le d’abord. Les photos nettes et bien éclairées où le sujet est dégagé s’animent bien plus sûrement que les images sombres ou chargées.

2
Deuxième étape

Décrire le mouvement, pas la photo

Le modèle voit déjà l’image. Consacrez le prompt au mouvement et à la caméra : « elle se tourne vers la fenêtre tandis que la caméra avance lentement ». Redécrire la tenue et la pièce gaspille le budget d’instructions.

3
Troisième étape

Ajouter une réplique si le sujet doit parler

Indiquez le locuteur et le ton entre crochets, puis la réplique entre guillemets : [jeune femme, voix calme] dit : « Je serai là dans cinq minutes. » Faites-la assez courte pour être réellement prononcée pendant la durée du clip.

4
Quatrième étape

Tester sans son, puis lancer la version finale

Générez cinq secondes sans audio pour 15 crédits afin de vérifier que le mouvement est naturel et que le visage reste stable. Une fois le résultat validé, activez le son et relancez la génération. Elle prend quelques minutes, et vous pouvez quitter la page.

Chronologie en lecture automatique

Un changement par génération

Ce modèle ne propose pas de seed : des paramètres identiques peuvent donc produire des clips différents. Changez un seul élément entre deux générations — le verbe de mouvement, la caméra ou la réplique — sinon vous ne saurez pas quelle modification a amélioré le résultat.

Sans seed : itérez par petites étapes
Kling 2.6

Kling 2.6 Image to Video

FAQ

Exigences concernant les images, audio, format d’image, durée des clips et coût en crédits du modèle Kling 2.6 Image to Video.

Une image par génération, au format JPEG ou PNG, de 10 Mo maximum. Le format WebP est refusé par ce point d’accès, même si d’autres modèles de ce site l’acceptent : si votre fichier est en WebP, convertissez-le en PNG ou JPEG avant l’importation. Le contrôle d’importation applique cette règle, de sorte qu’un fichier non pris en charge est détecté avant toute réservation de crédits.

Pas ici. Cette page accepte exactement une image. Wan 2.7 image to video sur ce site dispose d’emplacements dédiés à la première et à la dernière image si vous devez définir les deux extrémités d’un plan, tandis que Seedance 2.0 accepte jusqu’à cinq images de référence que vous pouvez désigner individuellement dans le prompt.

Entre 15 et 50 crédits, selon la durée et l’activation de l’audio : 15 pour cinq secondes sans son, 25 pour cinq secondes avec son ou dix secondes sans son, et 50 pour dix secondes avec son. Le prix est identique à celui de Kling 2.6 text to video : l’image d’entrée n’ajoute aucun coût.

Non, et vous n’en avez pas besoin. Le résultat suit le format de l’image importée : une photo 9:16 produit donc un clip 9:16. Pour contrôler la forme de la vidéo, recadrez la photo avant de l’importer.

Le modèle choisit une voix cohérente avec le sujet qu’il voit et synchronise la bouche avec celle-ci, mais vous ne pouvez pas fournir d’échantillon vocal précis sur ce point d’accès. Décrire le locuteur entre crochets — âge, genre, ton — est le seul moyen dont vous disposez pour contrôler le rendu de sa voix.

Uniquement avec l’autorisation de cette personne. Chaque envoi est contrôlé avant d’atteindre le modèle ; les images de personnes identifiables utilisées sans consentement, de personnalités publiques placées dans des situations fabriquées ou toute image à caractère sexuel impliquant une ressemblance réelle seront refusées. Vos propres photos, les personnes ayant donné leur accord et les images générées ou sous licence sont acceptées.

Quelques minutes, davantage pour les générations de dix secondes avec audio. Le clip terminé apparaît dans votre historique et reste disponible pendant sept jours ; téléchargez donc tout ce que vous prévoyez de réutiliser. En cas d’échec, les crédits réservés sont automatiquement restitués.

Essayez Kling 2.6 Image to Video

Importez une photo, décrivez le mouvement et voyez-la s’animer pour 15 crédits.