Hacer leer un guion a varias voces con la IA

El guion en PDF arrastrado al lienzo: un node Texto extrae de él diez réplicas listas para leer, un narrador para la acción y los personajes palabra por palabra, y un node Voz en modo diálogo las interpreta en una sola toma con tres voces de ElevenLabs. La lectura que se hace con actores, en tres clics. Todo el workflow se ve sin necesidad de cuenta.

El guion original de tres escenas, un PDF arrastrado al node MediaDemo interactiva

Workflow real, resultados reales. Muévete y haz zoom libremente.

Usar este workflow

El workflow real: el guion original de tres escenas en PDF en un node Media, Claude Sonnet 5 para las diez réplicas, un node Voz en modo diálogo sobre ElevenLabs Dialogue v3 con tres voces. Los textos mostrados son las respuestas de los modelos, sin retoques.

En resumen

Usted proporciona
1 PDF · un texto o un briefing
Lo que produce el workflow
1 voz en off
Estructura del canvas
4 nodes conectados por 1 enlaces
Modelos conectados
Claude Sonnet 5, ElevenLabs Dialogue v3
Coste de una pasada completa
unos 10 créditos, es decir 0,12 US$
Cuenta
La demo se puede ver sin cuenta; generar requiere una cuenta gratuita, con créditos de prueba incluidos

Un diálogo solo se juzga de oído. El PDF del guion entra en un node Media, y un node Texto lo lee a través de su puerto «Imagen o PDF a analizar» para extraer diez réplicas en formato NOMBRE: texto: un narrador que dice la acción esencial en una frase, y los personajes palabra por palabra, tal como en el guion.

El node Voz en modo diálogo lleva esas diez réplicas, cada una con su voz, y ElevenLabs Dialogue v3 las interpreta en un solo pase: los enlaces, los silencios, las reanudaciones vienen del modelo, no de un montaje. Tres voces en la demo: un narrador grave, una voz de mujer madura para Maren, una voz de hombre joven para Elias.

La demo lee las escenas 2 y 3 de «North of Silence», el guion original del template guion a película. Diez réplicas por node: para la siguiente escena, duplique el node Voz y pegue las diez siguientes, escritas por el node Texto. Sustituya el PDF por su guion y los nombres en la consigna.

Resultados reales de la demo

Estos son los archivos del flujo de trabajo anterior, tal como los produjeron los modelos, sin retoques. El punto de partida se indica cuando existe.

Resultado

La lectura de las escenas 2 y 3: diez réplicas interpretadas en una sola toma por ElevenLabs Dialogue v3, un narrador, Maren y EliasGenerado con ElevenLabs Dialogue v3

Para quién es

Guionistas, dramaturgos y autores de ficción que quieren escuchar un diálogo antes de reescribirlo o de hacerlo leer a actores.

Qué archivos proporcionar

Un guion o un capítulo en PDF de texto: los nombres en mayúsculas y las sluglines ayudan a separar la acción de las réplicas.

Cómo hacerlo

  1. 1

    Arrastre el guion en PDF

    Un node Media lo recibe. Formato de guion clásico preferiblemente: los nombres en mayúsculas y las sluglines ayudan al modelo a separar la acción de las réplicas.

  2. 2

    Deje que el node Texto escriba las réplicas

    Diez líneas en formato NOMBRE: texto, indicando las escenas a leer y los nombres de sus personajes en la consigna. NARRATOR resume la acción, los personajes hablan palabra por palabra.

  3. 3

    Pegue las réplicas en el node Voz

    El node Voz en modo diálogo tiene sus propias líneas: una réplica por línea, una voz por personaje elegida de la lista. Diez líneas por node; un segundo node para la siguiente escena.

  4. 4

    Escuche, luego ajuste

    Una toma interpreta todo el intercambio. Una réplica demasiado plana: añada una etiqueta de actuación, [sighs] o [whispers], en el texto. Una voz que no encaja: cámbiela en la línea, no en todo el node.

Variantes y casos de uso

El mismo canvas, ajustado a necesidades distintas: cada variante son dos o tres líneas de prompt que cambiar.

Esta es la demo: diez réplicas, dos personajes y un narrador, una toma. Para una escena más larga, dos nodes Voz de diez réplicas colocados uno tras otro en un node Montaje.

La lectura de una novela a varias voces

Un capítulo de novela en PDF también funciona: el narrador lee la prosa, los personajes los diálogos entre comillas. Pida al node Texto que conserve las frases exactas.

El doblaje de una historieta

Los bocadillos de una página, uno por línea con el nombre del personaje: el node Voz interpreta la página, y un node Montaje la coloca en pantalla con el sonido.

La prueba de casting vocal

Duplique el node Voz y cambie solo la voz de un personaje en cada copia: tres tomas, tres timbres, la comparación se hace de oído en un minuto.

La lectura en otro idioma

Pida al node Texto que traduzca las réplicas y ajuste el idioma del node Voz: ElevenLabs Dialogue interpreta catorce idiomas, con las mismas voces.

Errores frecuentes

Más de diez réplicas en un node

El modo diálogo admite diez líneas por toma. Una escena de treinta réplicas son tres nodes Voz, encadenados en un node Montaje con medio segundo de silencio entre tomas.

Dos voces demasiado parecidas

Dos timbres vecinos suenan como un monólogo. Elija una voz grave y una clara, o una mujer y un hombre, antes de buscar matices más finos.

Acotaciones leídas en voz alta

El narrador debe decir la acción en una frase, no las indicaciones entre paréntesis del guion. La consigna del node Texto lo pide: revise las diez líneas antes de pegarlas.

Modelos recomendados

Preguntas frecuentes

¿Por qué pegar las réplicas en el node Voz?

Porque el modo diálogo lleva sus líneas con una voz cada una, diez como máximo por toma: eso es lo que el modelo interpreta en un solo pase. El node Texto las prepara en el formato correcto, y pegarlas toma diez segundos.

¿Cuántas voces se pueden mezclar?

Una veintena de timbres de ElevenLabs, tantos como personajes haya en las diez réplicas. Tres en la demo: narrador, Maren, Elias. Voces de timbres opuestos se distinguen mejor que un monólogo.

¿Cuánto cuesta una lectura?

Una decena de créditos para diez réplicas: la lectura del PDF por Claude Sonnet 5 y el diálogo de ElevenLabs, facturado por carácter. El precio se muestra en el node antes de hacer clic.

¿Se puede usar la propia voz?

Sí: una voz clonada desde su biblioteca se elige en una línea como cualquier timbre. Clone primero la voz en un node Voz en off, luego asígnela al personaje.

¿Se pueden ajustar los silencios?

El modelo coloca las respiraciones por sí mismo. Para un silencio real, divida la lectura en dos nodes y deje un segundo entre ambos en el Montaje.

¿Qué idioma para la lectura?

El de las réplicas, ajustado en el node Voz: inglés en la demo, catorce idiomas disponibles. Un guion en español se lee en español, con las mismas voces.

¿Se puede exportar la lectura como vídeo?

Sí: un node Montaje con la portada o una imagen de la escena como clip, la lectura en la pista de audio, exporta un mp4 para redes sociales o una carpeta de producción.

Hacer leer un guion a varias voces con la IA

Usar este workflow

Cuenta gratuita, sin tarjeta bancaria. El workflow se abre ya rellenado en tu canvas.