Todas as ferramentas

Dublar um vídeo com IA, lábios sincronizados

Um vídeo em que alguém fala, uma nova voz em outro idioma: o Sync Lipsync 3 realinha os lábios ao novo texto. A mesma cena em inglês e em espanhol, sem refilmar. O workflow completo é visível sem conta.

Demo interativa

Workflow real, resultados reais. Desloque-se e faça zoom livremente.

Usar este workflow

O workflow real: o vídeo do avatar em um node de Mídia, duas traduções, cada uma lida por um node de Voz, e dois nodes de Vídeo configurados com Sync Lipsync 3 que recebem o vídeo pela porta de vídeo e a voz pela porta de voz.

Em resumo

O que o workflow produz
2 vídeos de 12 s em 720p, formato 9:16 · 2 vozes off
Estrutura do canvas
8 nodes ligados por 6 ligações
Modelos ligados
ElevenLabs v3, Sync Lipsync 3
Custo de uma passagem completa
cerca de 208 créditos, ou seja US$ 2,50

Um vídeo gravado uma vez, entregue em quantos idiomas forem necessários: é isso que a dublagem com sincronização labial faz. A pessoa na tela não diz mais a frase original, ela diz a tradução, e sua boca acompanha a nova voz quadro a quadro. O rosto, a iluminação, o enquadramento permanecem os da gravação.

O texto traduzido é lido em um node de Voz, com uma voz do catálogo ou uma voz clonada, a sua, por exemplo. O node de Vídeo configurado com Sync Lipsync 3 recebe o vídeo e a voz, e renderiza a cena dublada. O preço acompanha a duração produzida, medida nos seus dois arquivos, e aparece antes de você clicar.

A demonstração parte do vídeo do avatar falante, em francês, e o renderiza em inglês e depois em espanhol. Um anúncio, um vídeo de treinamento interno, uma apresentação de produto: uma gravação, um arquivo por mercado.

Como fazer

  1. 1

    Envie o vídeo falado

    Um rosto visto de frente, bem iluminado, com a boca visível, sem mão ou microfone na frente. Até dois minutos por passagem. Uma gravação feita com celular funciona.

  2. 2

    Escreva a tradução e escolha a voz

    Cada node de Voz lê um texto em um idioma. Escolha uma voz próxima à da pessoa, ou clone a voz dela para manter o timbre de um idioma para outro.

  3. 3

    Ajuste como as durações se encontram

    Por padrão, o resultado para na mais curta das duas durações. Se a voz for mais longa que a cena, escolha "repetir": o vídeo se repete sob a voz, o que funciona bem em uma tomada de frente para a câmera.

  4. 4

    Gere e compare

    Um node por idioma, todos conectados ao mesmo vídeo. O preço de cada um acompanha sua duração. Refaça apenas o idioma que não ficou bom.

Variantes e casos de uso

O mesmo canvas, afinado para necessidades diferentes: cada variante são duas ou três linhas de prompt a mudar.

O anúncio em cinco idiomas

Um anúncio gravado em francês se transforma em cinco arquivos: um node de Voz por idioma, um node Sync Lipsync 3 por idioma, o mesmo vídeo como entrada. O orçamento aparece em cada botão antes de iniciar.

O vídeo de treinamento traduzido

Um instrutor filmado de frente para a câmera, o texto traduzido por um node de Texto, lido por um node de Voz, e o vídeo dublado para as equipes no exterior. A edição permanece a mesma.

Corrigir uma frase sem refilmar

A dublagem também serve no mesmo idioma: uma frase falada errada, um preço que mudou, um nome a corrigir. Reescreva o texto, refaça, a boca acompanha.

O depoimento de cliente legendado, depois dublado

Um depoimento autêntico conquista um público estrangeiro sem perder o rosto da pessoa: dublem com uma voz próxima, e mantenha as legendas para acessibilidade.

O avatar gerado em todos os idiomas

Parta de um vídeo produzido pelo avatar falante ou por um anúncio UGC, e dublem: o personagem sintético fala cada idioma sem regenerar a cena.

Uma foto em vez de um vídeo

Se você não tem um vídeo de partida, faça uma foto falar: o InfiniTalk inventa o movimento do rosto a partir de um retrato e de uma voz.

Erros frequentes

Um vídeo com vários rostos

O modelo sincroniza um rosto. Com duas pessoas na tela, o resultado é imprevisível. Enquadre quem está falando.

Uma voz muito mais longa que a cena

No modo corte, o resultado para junto com o vídeo e o final do texto desaparece. Reduza a tradução ou passe para o modo repetição.

Uma boca escondida durante a gravação

Mão, microfone, xícara: tudo o que passa na frente da boca quebra a sincronização nesses quadros. Mantenha o rosto livre durante a gravação.

Esquecer a música e o ambiente sonoro

O resultado contém apenas a voz. Coloque a música de volta no node de Montagem, senão a versão dublada fica mais vazia do que a original.

Modelos recomendados

Perguntas frequentes

É preciso refilmar o vídeo para cada idioma?

Não: essa é toda a vantagem. Um único vídeo, um node de Voz por idioma, e os lábios acompanham cada tradução.

A voz original é mantida?

Não, a faixa de áudio do resultado é a voz conectada. Para manter uma música ou um ambiente sonoro, coloque-os de volta em um node de Montagem sobre o vídeo dublado.

É possível dublar com a própria voz em outro idioma?

Sim: clone sua voz no node de Voz, escreva a tradução, e a voz clonada a lê. Os lábios acompanham.

Qual duração de vídeo é aceita?

De um segundo a dois minutos por passagem. Além disso, corte o vídeo no node de Montagem e dublem os pedaços.

Quanto custa dublar um vídeo?

O preço acompanha a duração produzida, por segundo, e aparece no botão assim que o vídeo e a voz estão conectados. Uma falha técnica é reembolsada automaticamente.

A dublagem funciona em um vídeo gerado por IA?

Sim, tão bem quanto em uma gravação real. Uma cena Wan, Seedance ou Veo com um rosto de frente se dubla como qualquer vídeo.

É possível manter os gestos e as expressões?

Sim: apenas a boca é recalculada. As mãos, as sobrancelhas, os movimentos de cabeça são os da tomada original.

Qual voz escolher para uma dublagem convincente?

Uma voz no mesmo registro que a pessoa, ou o seu clone. Ouça a voz sozinha no node de Voz antes de iniciar a sincronização.

Dublar um vídeo com IA, lábios sincronizados

Usar este workflow

Conta gratuita, sem cartão. O workflow abre-se pré-preenchido no seu canvas.