Le message d'anniversaire
La photo de la personne fêtée, un texte de vingt mots lu par une voix chaleureuse : c'est le deuxième exemple de la démo. La vidéo s'envoie telle quelle par message, et personne n'a eu à se filmer.
Une photo de visage et un texte lu par une voix du catalogue : InfiniTalk fait parler la personne, lèvres, clignements et mouvements de tête compris. La vidéo dure ce que dure la voix. Le workflow entier se voit sans compte.
Vrai workflow, résultats réels. Déplacez-vous et zoomez librement.
Utiliser ce workflowLe vrai workflow : une photo dans un node Média, deux textes lus par un node Voix off chacun, et deux nodes Vidéo réglés sur InfiniTalk qui reçoivent la photo par le port image et la voix par le port voix.
En bref
Une seule photo suffit. Pas de vidéo à tourner, pas d'avatar à configurer : le visage de la photo se met à parler, avec les lèvres calées sur chaque syllabe, les clignements, les petits mouvements de tête qui accompagnent une phrase. Le résultat se regarde comme une prise face caméra, et il vient d'un portrait de téléphone.
Le texte se lit dans un node Voix off, avec l'une des voix du catalogue (ElevenLabs v3 en tête) ou une voix clonée. Le node Vidéo réglé sur InfiniTalk reçoit la photo et la voix, et rend une vidéo qui dure exactement ce que dure l'audio, jusqu'à vingt-huit secondes. Le prix suit cette durée, mesurée sur le fichier, et s'affiche avant de cliquer.
C'est le geste de l'avatar qui parle, mais à partir de VOTRE visage, ou de celui d'un personnage généré, d'une mascotte dessinée, d'un portrait ancien. Un message d'anniversaire, une présentation produit, une annonce sur les réseaux : la démo montre deux messages sur la même photo.
Choisissez une photo de face
Visage net, bouche fermée et visible, lumière de face, fond simple. Un portrait de téléphone convient très bien. Les lunettes et les barbes passent, une main devant la bouche ou un profil non.
Écrivez le texte et choisissez la voix
Le node Voix off lit ce que vous écrivez avec la voix choisie, dans votre langue. Une phrase de vingt mots fait sept à huit secondes. Générez la voix d'abord : c'est elle qui fixe la durée et le prix de la vidéo.
Générez la vidéo
Le node InfiniTalk affiche la durée mesurée de la voix et le prix exact. Cliquez : le visage parle, en 480p pour les réseaux ou en 720p pour un rendu à projeter.
Enchaînez si le texte est long
Au-delà de vingt-huit secondes de voix, coupez le texte en deux prises et montez-les bout à bout dans un node Montage, gratuitement, comme dans les autres workflows vidéo.
Le même canvas, réglé pour des besoins différents : chaque variante tient en deux ou trois lignes de prompt à changer.
La photo de la personne fêtée, un texte de vingt mots lu par une voix chaleureuse : c'est le deuxième exemple de la démo. La vidéo s'envoie telle quelle par message, et personne n'a eu à se filmer.
Un portrait généré devient un présentateur : le texte de lancement dans le node Voix off, la photo dans le node Média, et la vidéo sort en 720p, prête pour une page produit ou une pub UGC.
Une photo de famille numérisée, un texte écrit à la première personne : le visage s'anime et parle. Passez d'abord la photo dans un node Améliorer si elle est petite ou abîmée, puis dans InfiniTalk.
Un personnage dessiné avec une bouche lisible fonctionne : le modèle anime les lèvres d'un dessin comme celles d'une photo. Idéal pour une annonce de marque sur les réseaux, avec une voix enjouée du catalogue.
Une photo, trois nodes Voix off dans trois langues, trois nodes InfiniTalk : la même personne parle anglais, espagnol et français, avec les lèvres justes à chaque fois. Pour partir d'une vidéo déjà tournée, voyez le doublage.
Prenez la vidéo produite et passez-la dans faire danser une photo ou dans un node Vidéo en référence : la parole d'abord, le corps ensuite.
Le modèle a besoin de voir la bouche entière. De face ou en léger trois quarts, la synchronisation est propre ; de profil, les lèvres se déforment.
Sourire dents visibles, main sur le menton, micro devant : autant d'obstacles. Bouche fermée, visage dégagé, et le résultat est net.
Le prompt du node InfiniTalk décrit l'attitude, pas le texte. Ce que dit la personne, c'est la voix câblée : le texte va dans le node Voix off.
Au-delà de vingt-huit secondes, le node refuse avant de générer, sans débit. Coupez en deux prises et enchaînez-les dans le node Montage.
De deux à vingt-huit secondes par génération, soit une soixantaine de mots à un rythme normal. La vidéo dure exactement ce que dure la voix câblée : rien à régler.
Oui. Importez un enregistrement dans un node Média et branchez-le sur le port voix, ou clonez votre voix dans le node Voix off et faites-lui lire n'importe quel texte.
Les deux. Un portrait généré par un node Image, une mascotte dessinée ou une photo ancienne parlent aussi bien qu'un selfie, tant que le visage est de face et la bouche visible.
Non. Le prix est réservé au lancement et rendu automatiquement en cas d'échec technique. Le montant exact s'affiche sur le bouton avant de cliquer.
L'avatar qui parle génère un présentateur inventé avec sa voix, en une fois, sur Veo. Ici, c'est VOTRE photo qui parle, avec la voix de votre choix, et le texte se change sans regénérer le personnage.
Oui, dans le node Voix off : les voix ElevenLabs lisent quatorze langues. La synchronisation des lèvres suit les sons, quelle que soit la langue.
InfiniTalk rend un cadre proche de la photo, en 480p ou 720p. Pour un format précis, recadrez ensuite dans le node Montage, qui accepte le 9:16, le 1:1 et le 16:9.
Une personne par node. Pour un dialogue, faites deux photos parler chacune sur sa voix, puis alternez les plans dans un node Montage.
Faire parler une photo avec l'IA
Utiliser ce workflowCompte gratuit, sans carte bancaire. Le workflow s'ouvre pré-rempli dans votre canvas.