Choisissez une catégorie

3 modèles disponibles
8 modèles disponibles

3 modèles disponibles
5 modèles disponibles
6 modèles disponibles
3 modèles disponibles

8 modèles disponibles
Kling 2.6 Text to Video
Le mouvement cinématographique de Kling, désormais avec dialogue et son natifs.
Vision créative
Décrivez la scène et le mouvement. Avec le son activé, le dialogue entre guillemets est prononcé.
Paramètres vidéo
Ajoute des voix et des effets sonores. Double le coût en crédits.
Aperçu cinéma
Historique des générations0 enregistrements
Kling 2.6 : générateur texte en vidéo
Kling 2.6 génère l’image et le son ensemble : lorsqu’un prompt contient une réplique, la vidéo la fait réellement prononcer, avec des lèvres synchronisées. Lancé par Kuaishou en décembre 2025. Cinq ou dix secondes, trois formats et audio facultatif.
Décrivez le plan sous Visual: et les répliques sous Dialog: — c’est le format sur lequel ce modèle a été ajusté
Pourquoi choisir Kling 2.6 Text to Video
Kuaishou a lancé Kling 2.6 en décembre 2025 autour de la génération audiovisuelle simultanée : la bande-son est produite avec les images, au lieu d’être ajoutée ensuite. Cette page vous donne accès à cette fonction.
Des dialogues synchronisés avec les lèvres
Paroles, narration, chant, ambiances et effets sont générés avec l’image, ce qui accorde le rythme et les mouvements de la bouche. Kuaishou a entraîné cette version pour les répliques en anglais et en chinois.
L’audio reste un choix
Sans son, une vidéo de 5 secondes coûte 15 crédits. Avec le son, la même vidéo en coûte 25. Vous décidez à chaque génération si le plan a besoin d’être entendu, au lieu de payer un audio que vous couperez.
Des personnages cohérents entre les plans
Kuaishou a évalué la version 2.6 sur la cohérence des personnages entre les plans et annonce un suivi des instructions amélioré d’environ 15 % par rapport à la version 2.5. Un prompt décrivant deux plans conserve le même visage dans les deux.
Paysage, vertical ou carré
16:9, 9:16 et 1:1. Le vertical mérite l’attention : Kling vient d’une plateforme de vidéos courtes, et son cadrage 9:16 se comporte comme un format natif plutôt que comme un recadrage.
Cinq ou dix secondes
Deux durées fixes, sans curseur. Cinq secondes accueillent aisément une réplique ; dix permettent un court échange ou une réplique suivie d’un plan de réaction.
Crédits recrédités en cas d’échec
Les crédits sont réservés à l’envoi puis automatiquement recrédités si la génération échoue ou si le fournisseur ne répond jamais. Une vidéo non livrée ne vous coûte rien.
Tester sans son, finaliser avec l’audio
Un essai silencieux de 5 secondes coûte 15 crédits et permet d’ajuster le cadrage, le mouvement et le rythme. Activez l’audio uniquement pour la prise que vous souhaitez conserver.
Utiliser Kling 2.6 Text to Video
Ce modèle interprète mieux un prompt structuré qu’un paragraphe. Les exemples de Kuaishou séparent la description en un bloc visuel et un bloc de dialogue ; suivre cette structure est le principal levier de qualité sur cette page.
Rédiger le bloc visuel
Commencez par le décor, le sujet et la caméra : « Visual: dans une salle de répétition lumineuse, le soleil entre par la fenêtre, la caméra tourne lentement autour du groupe. » Les verbes de caméra sont efficaces : avancer, tourner autour, changer la mise au point, rester en plan large fixe.
Rédiger le bloc de dialogue
Indiquez ensuite la personne qui parle et son ton entre crochets, puis la réplique entre guillemets : Dialog: [présentatrice, voix enjouée] dit : « Polaire double face, trente dollars de réduction aujourd’hui. » Les locuteurs entre crochets permettent au modèle de distinguer deux voix.
Faire un essai sans son
Commencez par 5 secondes sans son pour 15 crédits. La composition, le mouvement et le sujet se jugent sans audio, et ce sont généralement eux qui demandent un nouvel essai. Ajustez-les avant de payer pour la voix.
Activer le son pour la prise retenue
Même prompt, audio activé : 25 crédits pour cinq secondes ou 50 pour dix. La génération prend quelques minutes. Vous pouvez quitter la page : la vidéo terminée apparaît dans l’historique avec sa piste audio.
Garder des répliques courtes
Le champ de prompt accepte 2 500 caractères, mais la vraie contrainte est le temps : une réplique de huit secondes ne tient pas dans une vidéo de cinq secondes. Comptez les mots à voix haute avant l’envoi.
Kling 2.6 Text to Video
FAQ
Audio, dialogues, formats, durée et coûts en crédits du modèle texte en vidéo Kling 2.6.
Kling 2.6 est un modèle de génération vidéo lancé par Kuaishou le 3 décembre 2025. Sa principale nouveauté par rapport à la version 2.5 est la génération audiovisuelle simultanée : les voix, effets sonores et ambiances sont produits avec les images, au lieu d’être ajoutés ensuite. Cette page utilise son point d’accès texte en vidéo. Vous fournissez le prompt et les paramètres ; nous gérons la génération, la comptabilisation des crédits et le stockage du résultat. FlowVeo3 est une plateforme indépendante, sans affiliation avec Kuaishou.
Entre 15 et 50 crédits, l’audio étant le facteur qui fait varier le montant. Cinq secondes sans son coûtent 15 crédits, cinq secondes avec son en coûtent 25 ; dix secondes sans son en coûtent 25, et dix secondes avec son en coûtent 50. Le coût exact de vos paramètres s’affiche au-dessus du bouton de génération avant l’envoi.
Parce qu’elle double le coût facturé par le fournisseur : le son et l’image sont générés ensemble, pour un coût par vidéo deux fois plus élevé. Nous répercutons cette structure plutôt que de la moyenner dans un prix unique supérieur, ce qui maintient les essais silencieux à un tarif bas.
Kuaishou a conçu la version 2.6 pour la parole en anglais et en chinois : ce sont les deux langues sur lesquelles vous pouvez compter. Rédigez la réplique dans la langue souhaitée : le modèle prononce votre texte sans le traduire.
Non. Ce point d’accès ne propose aucun réglage de résolution : le modèle renvoie son propre format de sortie, sans option basse résolution moins chère pour les essais. Pour choisir la résolution, Wan 2.6 texte en vidéo propose le 720p et le 1080p, tandis que Seedance 2.0 va du 480p à la 4K.
Ni l’un ni l’autre. Kling 2.6 propose le prompt, la durée, le format et l’activation du son. Deux générations avec le même prompt différeront donc, et vous ne pourrez pas reproduire exactement une vidéo précédente. Pour disposer d’un seed fixe et d’un prompt négatif, utilisez Wan 2.7 texte en vidéo sur ce site.
Généralement quelques minutes, davantage pour dix secondes avec audio. Vous pouvez quitter la page pendant la génération ; la vidéo apparaît dans votre historique une fois terminée. Les vidéos générées restent disponibles pendant sept jours : téléchargez celles que vous souhaitez conserver.
Essayer Kling 2.6 Text to Video
Cinq secondes sans son coûtent 15 crédits et permettent de vérifier le plan avant de payer pour la voix.