Kling 2.6 Text to Video

Le mouvement cinématographique de Kling, désormais avec dialogue et son natifs.

5/10sAudio15-50 créditsTexte en vidéo

Vision créative

Décrivez la scène et le mouvement. Avec le son activé, le dialogue entre guillemets est prononcé.

0/2500

Paramètres vidéo

Ajoute des voix et des effets sonores. Double le coût en crédits.

Coût de production
15
Solde de crédits
Chargement...

Aperçu cinéma

Prêt pour la production
Configurez vos paramètres et commencez à créer votre œuvre cinématographique

Historique des générations0 enregistrements

10 derniers enregistrements • Disponible pendant 7 jours

Kling 2.6 : générateur texte en vidéo

Kling 2.6 génère l’image et le son ensemble : lorsqu’un prompt contient une réplique, la vidéo la fait réellement prononcer, avec des lèvres synchronisées. Lancé par Kuaishou en décembre 2025. Cinq ou dix secondes, trois formats et audio facultatif.

Décrivez le plan sous Visual: et les répliques sous Dialog: — c’est le format sur lequel ce modèle a été ajusté

Kling 2.6

Pourquoi choisir Kling 2.6 Text to Video

Kuaishou a lancé Kling 2.6 en décembre 2025 autour de la génération audiovisuelle simultanée : la bande-son est produite avec les images, au lieu d’être ajoutée ensuite. Cette page vous donne accès à cette fonction.

Audio

Des dialogues synchronisés avec les lèvres

Paroles, narration, chant, ambiances et effets sont générés avec l’image, ce qui accorde le rythme et les mouvements de la bouche. Kuaishou a entraîné cette version pour les répliques en anglais et en chinois.

Maîtrise des coûts

L’audio reste un choix

Sans son, une vidéo de 5 secondes coûte 15 crédits. Avec le son, la même vidéo en coûte 25. Vous décidez à chaque génération si le plan a besoin d’être entendu, au lieu de payer un audio que vous couperez.

Direction

Des personnages cohérents entre les plans

Kuaishou a évalué la version 2.6 sur la cohérence des personnages entre les plans et annonce un suivi des instructions amélioré d’environ 15 % par rapport à la version 2.5. Un prompt décrivant deux plans conserve le même visage dans les deux.

Format

Paysage, vertical ou carré

16:9, 9:16 et 1:1. Le vertical mérite l’attention : Kling vient d’une plateforme de vidéos courtes, et son cadrage 9:16 se comporte comme un format natif plutôt que comme un recadrage.

Durée

Cinq ou dix secondes

Deux durées fixes, sans curseur. Cinq secondes accueillent aisément une réplique ; dix permettent un court échange ou une réplique suivie d’un plan de réaction.

Facturation

Crédits recrédités en cas d’échec

Les crédits sont réservés à l’envoi puis automatiquement recrédités si la génération échoue ou si le fournisseur ne répond jamais. Une vidéo non livrée ne vous coûte rien.

Tester sans son, finaliser avec l’audio

Un essai silencieux de 5 secondes coûte 15 crédits et permet d’ajuster le cadrage, le mouvement et le rythme. Activez l’audio uniquement pour la prise que vous souhaitez conserver.

De 15 à 50 crédits par vidéo
Étape par étape

Utiliser Kling 2.6 Text to Video

Ce modèle interprète mieux un prompt structuré qu’un paragraphe. Les exemples de Kuaishou séparent la description en un bloc visuel et un bloc de dialogue ; suivre cette structure est le principal levier de qualité sur cette page.

1
Première étape

Rédiger le bloc visuel

Commencez par le décor, le sujet et la caméra : « Visual: dans une salle de répétition lumineuse, le soleil entre par la fenêtre, la caméra tourne lentement autour du groupe. » Les verbes de caméra sont efficaces : avancer, tourner autour, changer la mise au point, rester en plan large fixe.

2
Deuxième étape

Rédiger le bloc de dialogue

Indiquez ensuite la personne qui parle et son ton entre crochets, puis la réplique entre guillemets : Dialog: [présentatrice, voix enjouée] dit : « Polaire double face, trente dollars de réduction aujourd’hui. » Les locuteurs entre crochets permettent au modèle de distinguer deux voix.

3
Troisième étape

Faire un essai sans son

Commencez par 5 secondes sans son pour 15 crédits. La composition, le mouvement et le sujet se jugent sans audio, et ce sont généralement eux qui demandent un nouvel essai. Ajustez-les avant de payer pour la voix.

4
Quatrième étape

Activer le son pour la prise retenue

Même prompt, audio activé : 25 crédits pour cinq secondes ou 50 pour dix. La génération prend quelques minutes. Vous pouvez quitter la page : la vidéo terminée apparaît dans l’historique avec sa piste audio.

Chronologie en lecture automatique

Garder des répliques courtes

Le champ de prompt accepte 2 500 caractères, mais la vraie contrainte est le temps : une réplique de huit secondes ne tient pas dans une vidéo de cinq secondes. Comptez les mots à voix haute avant l’envoi.

2 500 caractères, 5 ou 10 secondes
Kling 2.6

Kling 2.6 Text to Video

FAQ

Audio, dialogues, formats, durée et coûts en crédits du modèle texte en vidéo Kling 2.6.

Kling 2.6 est un modèle de génération vidéo lancé par Kuaishou le 3 décembre 2025. Sa principale nouveauté par rapport à la version 2.5 est la génération audiovisuelle simultanée : les voix, effets sonores et ambiances sont produits avec les images, au lieu d’être ajoutés ensuite. Cette page utilise son point d’accès texte en vidéo. Vous fournissez le prompt et les paramètres ; nous gérons la génération, la comptabilisation des crédits et le stockage du résultat. FlowVeo3 est une plateforme indépendante, sans affiliation avec Kuaishou.

Entre 15 et 50 crédits, l’audio étant le facteur qui fait varier le montant. Cinq secondes sans son coûtent 15 crédits, cinq secondes avec son en coûtent 25 ; dix secondes sans son en coûtent 25, et dix secondes avec son en coûtent 50. Le coût exact de vos paramètres s’affiche au-dessus du bouton de génération avant l’envoi.

Parce qu’elle double le coût facturé par le fournisseur : le son et l’image sont générés ensemble, pour un coût par vidéo deux fois plus élevé. Nous répercutons cette structure plutôt que de la moyenner dans un prix unique supérieur, ce qui maintient les essais silencieux à un tarif bas.

Kuaishou a conçu la version 2.6 pour la parole en anglais et en chinois : ce sont les deux langues sur lesquelles vous pouvez compter. Rédigez la réplique dans la langue souhaitée : le modèle prononce votre texte sans le traduire.

Non. Ce point d’accès ne propose aucun réglage de résolution : le modèle renvoie son propre format de sortie, sans option basse résolution moins chère pour les essais. Pour choisir la résolution, Wan 2.6 texte en vidéo propose le 720p et le 1080p, tandis que Seedance 2.0 va du 480p à la 4K.

Ni l’un ni l’autre. Kling 2.6 propose le prompt, la durée, le format et l’activation du son. Deux générations avec le même prompt différeront donc, et vous ne pourrez pas reproduire exactement une vidéo précédente. Pour disposer d’un seed fixe et d’un prompt négatif, utilisez Wan 2.7 texte en vidéo sur ce site.

Généralement quelques minutes, davantage pour dix secondes avec audio. Vous pouvez quitter la page pendant la génération ; la vidéo apparaît dans votre historique une fois terminée. Les vidéos générées restent disponibles pendant sept jours : téléchargez celles que vous souhaitez conserver.

Essayer Kling 2.6 Text to Video

Cinq secondes sans son coûtent 15 crédits et permettent de vérifier le plan avant de payer pour la voix.