Choisissez une catégorie

3 modèles disponibles
8 modèles disponibles

3 modèles disponibles
5 modèles disponibles
6 modèles disponibles
3 modèles disponibles

8 modèles disponibles
Kling 2.6 Image to Video
Animez une photo avec le mouvement Kling, et faites-la parler.
Vision créative
Décrivez le mouvement. Avec le son activé, le dialogue entre guillemets est prononcé.
Paramètres vidéo
Ajoute des voix et des effets sonores. Double le coût en crédits.
Aperçu cinéma
Historique des générations0 enregistrements
Générateur Kling 2.6 Image to Video
Importez une photo et Kling 2.6 l’anime — et, si vous le souhaitez, donne une voix à la personne représentée. Le modèle de Kuaishou de décembre 2025 génère la parole et l’image en une seule passe : une réplique écrite dans le prompt revient donc prononcée et synchronisée. Cinq ou dix secondes, à partir de 15 crédits.
Le clip conserve le format de votre image : recadrez la photo avant de l’importer, pas après
Pourquoi choisir Kling 2.6 Image to Video
La plupart des modèles d’image vers vidéo produisent du mouvement, mais restent silencieux. Kling 2.6 est le modèle de ce site où une photographie immobile peut finalement parler : l’audio est généré avec les images, ce qui permet de synchroniser la bouche et la voix.
Une seule photo suffit
Importez un fichier JPEG ou PNG unique de 10 Mo maximum et décrivez le mouvement. L’image définit le sujet, l’éclairage et le cadrage ; le prompt n’a donc qu’à préciser ce qui change.
Donner une voix au sujet
Écrivez une réplique entre guillemets et indiquez le locuteur entre crochets : la personne de votre photo la prononcera avec des mouvements de lèvres synchronisés. Kuaishou a optimisé la version 2.6 pour les dialogues en anglais et en chinois.
Votre image définit le cadre
Il n’y a pas de réglage du format d’image ici, et c’est volontaire : le clip reprend la forme de votre import. Une photo verticale prise au téléphone produit une vidéo verticale, sans recadrage ni bandes noires.
Ne payer le son que lorsque vous en avez besoin
Cinq secondes sans son coûtent 15 crédits, et 25 avec audio. Dix secondes coûtent 25 sans son et 50 avec son. Les tests de mouvement utilisent le tarif le plus bas ; seule la prise finale inclut le coût de la voix.
Le visage reste le même
La cohérence du personnage d’un plan à l’autre faisait partie des objectifs annoncés par Kuaishou pour la version 2.6. Elle compte davantage ici qu’en texte vers vidéo : la référence est une personne réelle à laquelle vous pouvez comparer le résultat.
Les générations échouées sont remboursées
Les crédits sont réservés lors de l’envoi et automatiquement restitués si la génération échoue ou si le fournisseur ne répond jamais, y compris lorsque la génération est refusée à cause d’une image d’entrée inutilisable.
Le même prix que texte vers vidéo
Ajouter une image ne coûte rien de plus. Un clip basé sur une photo et un clip créé uniquement avec un prompt, de même durée et avec le même réglage audio, sont facturés de façon identique.
Comment utiliser Kling 2.6 Image to Video
Deux éléments déterminent le résultat : la photo fournie et la façon dont vous formulez le mouvement. Le prompt ne décrit pas une scène à partir de zéro ; il décrit ce qui change dans une scène déjà existante.
Importer un fichier JPEG ou PNG
Une image de 10 Mo maximum. Le format WebP n’est pas accepté par ce point d’accès : convertissez-le d’abord. Les photos nettes et bien éclairées où le sujet est dégagé s’animent bien plus sûrement que les images sombres ou chargées.
Décrire le mouvement, pas la photo
Le modèle voit déjà l’image. Consacrez le prompt au mouvement et à la caméra : « elle se tourne vers la fenêtre tandis que la caméra avance lentement ». Redécrire la tenue et la pièce gaspille le budget d’instructions.
Ajouter une réplique si le sujet doit parler
Indiquez le locuteur et le ton entre crochets, puis la réplique entre guillemets : [jeune femme, voix calme] dit : « Je serai là dans cinq minutes. » Faites-la assez courte pour être réellement prononcée pendant la durée du clip.
Tester sans son, puis lancer la version finale
Générez cinq secondes sans audio pour 15 crédits afin de vérifier que le mouvement est naturel et que le visage reste stable. Une fois le résultat validé, activez le son et relancez la génération. Elle prend quelques minutes, et vous pouvez quitter la page.
Un changement par génération
Ce modèle ne propose pas de seed : des paramètres identiques peuvent donc produire des clips différents. Changez un seul élément entre deux générations — le verbe de mouvement, la caméra ou la réplique — sinon vous ne saurez pas quelle modification a amélioré le résultat.
Kling 2.6 Image to Video
FAQ
Exigences concernant les images, audio, format d’image, durée des clips et coût en crédits du modèle Kling 2.6 Image to Video.
Une image par génération, au format JPEG ou PNG, de 10 Mo maximum. Le format WebP est refusé par ce point d’accès, même si d’autres modèles de ce site l’acceptent : si votre fichier est en WebP, convertissez-le en PNG ou JPEG avant l’importation. Le contrôle d’importation applique cette règle, de sorte qu’un fichier non pris en charge est détecté avant toute réservation de crédits.
Pas ici. Cette page accepte exactement une image. Wan 2.7 image to video sur ce site dispose d’emplacements dédiés à la première et à la dernière image si vous devez définir les deux extrémités d’un plan, tandis que Seedance 2.0 accepte jusqu’à cinq images de référence que vous pouvez désigner individuellement dans le prompt.
Entre 15 et 50 crédits, selon la durée et l’activation de l’audio : 15 pour cinq secondes sans son, 25 pour cinq secondes avec son ou dix secondes sans son, et 50 pour dix secondes avec son. Le prix est identique à celui de Kling 2.6 text to video : l’image d’entrée n’ajoute aucun coût.
Non, et vous n’en avez pas besoin. Le résultat suit le format de l’image importée : une photo 9:16 produit donc un clip 9:16. Pour contrôler la forme de la vidéo, recadrez la photo avant de l’importer.
Le modèle choisit une voix cohérente avec le sujet qu’il voit et synchronise la bouche avec celle-ci, mais vous ne pouvez pas fournir d’échantillon vocal précis sur ce point d’accès. Décrire le locuteur entre crochets — âge, genre, ton — est le seul moyen dont vous disposez pour contrôler le rendu de sa voix.
Uniquement avec l’autorisation de cette personne. Chaque envoi est contrôlé avant d’atteindre le modèle ; les images de personnes identifiables utilisées sans consentement, de personnalités publiques placées dans des situations fabriquées ou toute image à caractère sexuel impliquant une ressemblance réelle seront refusées. Vos propres photos, les personnes ayant donné leur accord et les images générées ou sous licence sont acceptées.
Quelques minutes, davantage pour les générations de dix secondes avec audio. Le clip terminé apparaît dans votre historique et reste disponible pendant sept jours ; téléchargez donc tout ce que vous prévoyez de réutiliser. En cas d’échec, les crédits réservés sont automatiquement restitués.
Essayez Kling 2.6 Image to Video
Importez une photo, décrivez le mouvement et voyez-la s’animer pour 15 crédits.