Fazer a IA ler um roteiro com várias vozes

O roteiro em PDF arrastado para o canvas: um node Texto extrai dez falas prontas para leitura, um narrador para a ação e os personagens palavra por palavra, e um node Voz em modo diálogo as interpreta em uma única tomada com três vozes ElevenLabs. A leitura que se faz com atores, em três cliques. Todo o workflow é visível sem conta.

O roteiro original de três cenas, um PDF arrastado para o node MídiaDemo interativa

Workflow real, resultados reais. Desloque-se e faça zoom livremente.

Usar este workflow

O workflow real: o roteiro original de três cenas em PDF em um node Mídia, Claude Sonnet 5 para as dez falas, um node Voz em modo diálogo com ElevenLabs Dialogue v3 e três vozes. Os textos exibidos são as respostas dos modelos, sem retoques.

Em resumo

Você fornece
1 PDF · um texto ou um briefing
O que o workflow produz
1 voz off
Estrutura do canvas
4 nodes ligados por 1 ligações
Modelos ligados
Claude Sonnet 5, ElevenLabs Dialogue v3
Custo de uma passagem completa
cerca de 10 créditos, ou seja US$ 0,12
Conta
A demonstração pode ser vista sem conta; para gerar é preciso ter uma conta gratuita, com créditos de teste incluídos

Um diálogo só se julga de ouvido. O PDF do roteiro entra em um node Mídia, e um node Texto o lê pela porta "Imagem ou PDF para analisar" para extrair dez falas no formato NOME: texto: um narrador que conta a ação essencial em uma frase, e os personagens palavra por palavra, como no script.

O node Voz em modo diálogo carrega essas dez falas, cada uma com sua voz, e o ElevenLabs Dialogue v3 as interpreta em uma única passagem: os encadeamentos, os silêncios, as retomadas vêm do modelo, não de uma edição. Três vozes na demo: um narrador grave, uma voz de mulher madura para Maren, uma voz de jovem para Elias.

A demo apresenta as cenas 2 e 3 de "North of Silence", o roteiro original do template roteiro em filme. Dez falas por node: para a cena seguinte, duplique o node Voz e cole as dez seguintes, escritas pelo node Texto. Substitua o PDF pelo seu roteiro e os nomes na instrução.

Resultados reais da demonstração

Estes são os arquivos do workflow acima, exatamente como os modelos os produziram, sem retoques. O ponto de partida é indicado quando existe um.

Resultado

A leitura das cenas 2 e 3: dez falas interpretadas em uma única tomada pelo ElevenLabs Dialogue v3, um narrador, Maren e EliasGerado com ElevenLabs Dialogue v3

Para quem é

Roteiristas, dramaturgos e autores de ficção que querem ouvir um diálogo antes de reescrevê-lo ou de fazê-lo ler por atores.

Quais arquivos fornecer

Um roteiro ou um capítulo em PDF de texto: os nomes em maiúsculas e as sluglines ajudam a separar a ação das falas.

Como fazer

  1. 1

    Arraste o roteiro em PDF

    Um node Mídia o recebe. Formato clássico de roteiro de preferência: os nomes em maiúsculas e as sluglines ajudam o modelo a separar a ação das falas.

  2. 2

    Deixe o node Texto escrever as falas

    Dez linhas no formato NOME: texto, indicando as cenas a ler e os nomes dos seus personagens na instrução. NARRATOR resume a ação, os personagens falam palavra por palavra.

  3. 3

    Cole as falas no node Voz

    O node Voz em modo diálogo tem suas próprias linhas: uma fala por linha, uma voz por personagem escolhida na lista. Dez linhas por node; um segundo node para a cena seguinte.

  4. 4

    Escute, depois ajuste

    Uma tomada interpreta toda a troca. Uma fala muito monótona: adicione uma marcação de interpretação, [sighs] ou [whispers], no texto. Uma voz que não combina: troque-a na linha, não no node inteiro.

Variantes e casos de uso

O mesmo canvas, afinado para necessidades diferentes: cada variante são duas ou três linhas de prompt a mudar.

É a demo: dez falas, dois personagens e um narrador, uma tomada. Para uma cena mais longa, dois nodes Voz de dez falas colocados um após o outro em um node Montagem.

A leitura de um romance com várias vozes

Um capítulo de romance em PDF também funciona: o narrador lê a prosa, os personagens os diálogos entre aspas. Peça ao node Texto para manter as frases exatas.

A dublagem de uma história em quadrinhos

Os balões de uma página, um por linha com o nome do personagem: o node Voz interpreta a página, e um node Montagem a coloca na tela com o som.

O teste de escolha de vozes

Duplique o node Voz e mude apenas a voz de um personagem em cada cópia: três tomadas, três timbres, a comparação se faz de ouvido em um minuto.

A leitura em outro idioma

Peça ao node Texto para traduzir as falas e ajuste o idioma do node Voz: o ElevenLabs Dialogue interpreta quatorze idiomas, com as mesmas vozes.

Erros frequentes

Mais de dez falas em um node

O modo diálogo aceita dez linhas por tomada. Uma cena de trinta falas são três nodes Voz, encadeados em um node Montagem com meio segundo de silêncio entre as tomadas.

Duas vozes muito parecidas

Dois timbres próximos soam como um monólogo. Escolha uma voz grave e uma voz clara, ou uma mulher e um homem, antes de buscar nuances mais finas.

Rubricas lidas em voz alta

O narrador deve dizer a ação em uma frase, não as indicações entre parênteses do roteiro. A instrução do node Texto pede isso: verifique as dez linhas antes de colar.

Modelos recomendados

Perguntas frequentes

Por que colar as falas no node Voz?

Porque o modo diálogo carrega suas linhas com uma voz cada, dez no máximo por tomada: é isso que o modelo interpreta em uma única passagem. O node Texto as prepara no formato certo, e colar leva dez segundos.

Quantas vozes podem ser misturadas?

Cerca de vinte timbres ElevenLabs, tantos quanto personagens nas dez falas. Três na demo: narrador, Maren, Elias. Vozes de timbres opostos se distinguem melhor do que em um monólogo.

Quanto custa uma leitura?

Cerca de dez créditos para dez falas: a leitura do PDF pelo Claude Sonnet 5 e o diálogo ElevenLabs, cobrado por caractere. O preço é exibido no node antes de clicar.

É possível usar a própria voz?

Sim: uma voz clonada da sua biblioteca é escolhida em uma linha como qualquer outro timbre. Clone primeiro a voz em um node Voz off, depois atribua-a ao personagem.

Os silêncios são ajustáveis?

O modelo coloca as respirações por conta própria. Para um silêncio real, divida a leitura em dois nodes e deixe um segundo entre eles na Montagem.

Qual idioma usar para a leitura?

O das falas, ajustado no node Voz: inglês na demo, quatorze idiomas disponíveis. Um roteiro em francês é lido em francês, com as mesmas vozes.

É possível exportar a leitura em vídeo?

Sim: um node Montagem com a capa ou uma imagem da cena como clipe, a leitura na trilha de áudio, exporta um mp4 para redes sociais ou uma pasta de produção.

Fazer a IA ler um roteiro com várias vozes

Usar este workflow

Conta gratuita, sem cartão. O workflow abre-se pré-preenchido no seu canvas.