A mensagem de aniversário
A foto do aniversariante, um texto de vinte palavras lido por uma voz calorosa: esse é o segundo exemplo da demonstração. O vídeo é enviado do jeito que está por mensagem, e ninguém precisou se filmar.
Uma foto de rosto e um texto lido por uma voz do catálogo: o InfiniTalk faz a pessoa falar, com lábios, piscadas e movimentos de cabeça incluídos. O vídeo dura o tempo da voz. Todo o workflow é visível sem conta.
Workflow real, resultados reais. Desloque-se e faça zoom livremente.
Usar este workflowO workflow real: uma foto em um node Média, dois textos lidos cada um por um node Voz-off, e dois nodes Vídeo configurados para InfiniTalk que recebem a foto pela porta de imagem e a voz pela porta de voz.
Em resumo
Uma única foto basta. Sem vídeo para filmar, sem avatar para configurar: o rosto da foto começa a falar, com os lábios ajustados a cada sílaba, as piscadas, os pequenos movimentos de cabeça que acompanham uma frase. O resultado se assiste como uma tomada de frente para a câmera, e vem de um retrato feito com o telefone.
O texto é lido em um node Voz-off, com uma das vozes do catálogo (ElevenLabs v3 em destaque) ou uma voz clonada. O node Vídeo configurado para InfiniTalk recebe a foto e a voz, e renderiza um vídeo que dura exatamente o tempo do áudio, até vinte e oito segundos. O preço acompanha essa duração, medida no arquivo, e aparece antes de você clicar.
É o gesto do avatar que fala, mas a partir do SEU rosto, ou do de um personagem gerado, de uma mascote desenhada, de um retrato antigo. Uma mensagem de aniversário, uma apresentação de produto, um anúncio nas redes: a demonstração mostra duas mensagens na mesma foto.
Escolha uma foto de frente
Rosto nítido, boca fechada e visível, luz de frente, fundo simples. Um retrato de telefone funciona muito bem. Óculos e barbas passam, uma mão na frente da boca ou um perfil não.
Escreva o texto e escolha a voz
O node Voz-off lê o que você escreve com a voz escolhida, no seu idioma. Uma frase de vinte palavras dura sete a oito segundos. Gere a voz primeiro: é ela que define a duração e o preço do vídeo.
Gere o vídeo
O node InfiniTalk mostra a duração medida da voz e o preço exato. Clique: o rosto fala, em 480p para as redes ou em 720p para uma projeção.
Encadeie se o texto for longo
Acima de vinte e oito segundos de voz, divida o texto em duas tomadas e edite-as em sequência em um node Montagem, gratuitamente, como nos outros workflows de vídeo.
O mesmo canvas, afinado para necessidades diferentes: cada variante são duas ou três linhas de prompt a mudar.
A foto do aniversariante, um texto de vinte palavras lido por uma voz calorosa: esse é o segundo exemplo da demonstração. O vídeo é enviado do jeito que está por mensagem, e ninguém precisou se filmar.
Um retrato gerado se torna um apresentador: o texto de lançamento no node Voz-off, a foto no node Média, e o vídeo sai em 720p, pronto para uma página de produto ou um anúncio UGC.
Uma foto de família digitalizada, um texto escrito na primeira pessoa: o rosto ganha vida e fala. Passe primeiro a foto por um node Melhorar se ela estiver pequena ou danificada, depois pelo InfiniTalk.
Um personagem desenhado com uma boca legível funciona: o modelo anima os lábios de um desenho como os de uma foto. Ideal para um anúncio de marca nas redes, com uma voz animada do catálogo.
Uma foto, três nodes Voz-off em três idiomas, três nodes InfiniTalk: a mesma pessoa fala inglês, espanhol e português, com os lábios certos a cada vez. Para partir de um vídeo já filmado, veja a dublagem.
Pegue o vídeo produzido e passe-o por fazer uma foto dançar ou em um node Vídeo como referência: a fala primeiro, o corpo depois.
O modelo precisa ver a boca inteira. De frente ou em leve três quartos, a sincronização é limpa; de perfil, os lábios se distorcem.
Sorriso com dentes visíveis, mão no queixo, microfone na frente: tantos obstáculos. Boca fechada, rosto livre, e o resultado é nítido.
O prompt do node InfiniTalk descreve a atitude, não o texto. O que a pessoa diz é a voz conectada: o texto vai no node Voz-off.
Acima de vinte e oito segundos, o node recusa antes de gerar, sem cobrança. Divida em duas tomadas e encadeie-as no node Montagem.
De dois a vinte e oito segundos por geração, cerca de setenta palavras em ritmo normal. O vídeo dura exatamente o tempo da voz conectada: nada para ajustar.
Sim. Importe uma gravação em um node Média e conecte-a à porta de voz, ou clone sua voz no node Voz-off e faça-a ler qualquer texto.
Os dois. Um retrato gerado por um node Imagem, uma mascote desenhada ou uma foto antiga falam tão bem quanto uma selfie, desde que o rosto esteja de frente e a boca visível.
Não. O preço é reservado no início e devolvido automaticamente em caso de falha técnica. O valor exato aparece no botão antes de você clicar.
O avatar que fala gera um apresentador inventado com sua voz, de uma vez, no Veo. Aqui, é a SUA foto que fala, com a voz de sua escolha, e o texto muda sem regenerar o personagem.
Sim, no node Voz-off: as vozes ElevenLabs leem quatorze idiomas. A sincronização labial acompanha os sons, seja qual for o idioma.
O InfiniTalk renderiza um quadro próximo ao da foto, em 480p ou 720p. Para um formato preciso, recorte depois no node Montagem, que aceita 9:16, 1:1 e 16:9.
Uma pessoa por node. Para um diálogo, faça duas fotos falarem cada uma na sua voz, depois alterne os planos em um node Montagem.
Fazer uma foto falar com IA
Usar este workflowConta gratuita, sem cartão. O workflow abre-se pré-preenchido no seu canvas.