La lectura de una escena de diálogo
Esta es la demo: diez réplicas, dos personajes y un narrador, una toma. Para una escena más larga, dos nodes Voz de diez réplicas colocados uno tras otro en un node Montaje.
El guion en PDF arrastrado al lienzo: un node Texto extrae de él diez réplicas listas para leer, un narrador para la acción y los personajes palabra por palabra, y un node Voz en modo diálogo las interpreta en una sola toma con tres voces de ElevenLabs. La lectura que se hace con actores, en tres clics. Todo el workflow se ve sin necesidad de cuenta.
El workflow real: el guion original de tres escenas en PDF en un node Media, Claude Sonnet 5 para las diez réplicas, un node Voz en modo diálogo sobre ElevenLabs Dialogue v3 con tres voces. Los textos mostrados son las respuestas de los modelos, sin retoques.
En resumen
Un diálogo solo se juzga de oído. El PDF del guion entra en un node Media, y un node Texto lo lee a través de su puerto «Imagen o PDF a analizar» para extraer diez réplicas en formato NOMBRE: texto: un narrador que dice la acción esencial en una frase, y los personajes palabra por palabra, tal como en el guion.
El node Voz en modo diálogo lleva esas diez réplicas, cada una con su voz, y ElevenLabs Dialogue v3 las interpreta en un solo pase: los enlaces, los silencios, las reanudaciones vienen del modelo, no de un montaje. Tres voces en la demo: un narrador grave, una voz de mujer madura para Maren, una voz de hombre joven para Elias.
La demo lee las escenas 2 y 3 de «North of Silence», el guion original del template guion a película. Diez réplicas por node: para la siguiente escena, duplique el node Voz y pegue las diez siguientes, escritas por el node Texto. Sustituya el PDF por su guion y los nombres en la consigna.
Estos son los archivos del flujo de trabajo anterior, tal como los produjeron los modelos, sin retoques. El punto de partida se indica cuando existe.
Resultado
Guionistas, dramaturgos y autores de ficción que quieren escuchar un diálogo antes de reescribirlo o de hacerlo leer a actores.
Un guion o un capítulo en PDF de texto: los nombres en mayúsculas y las sluglines ayudan a separar la acción de las réplicas.
Arrastre el guion en PDF
Un node Media lo recibe. Formato de guion clásico preferiblemente: los nombres en mayúsculas y las sluglines ayudan al modelo a separar la acción de las réplicas.
Deje que el node Texto escriba las réplicas
Diez líneas en formato NOMBRE: texto, indicando las escenas a leer y los nombres de sus personajes en la consigna. NARRATOR resume la acción, los personajes hablan palabra por palabra.
Pegue las réplicas en el node Voz
El node Voz en modo diálogo tiene sus propias líneas: una réplica por línea, una voz por personaje elegida de la lista. Diez líneas por node; un segundo node para la siguiente escena.
Escuche, luego ajuste
Una toma interpreta todo el intercambio. Una réplica demasiado plana: añada una etiqueta de actuación, [sighs] o [whispers], en el texto. Una voz que no encaja: cámbiela en la línea, no en todo el node.
El mismo canvas, ajustado a necesidades distintas: cada variante son dos o tres líneas de prompt que cambiar.
Esta es la demo: diez réplicas, dos personajes y un narrador, una toma. Para una escena más larga, dos nodes Voz de diez réplicas colocados uno tras otro en un node Montaje.
Un capítulo de novela en PDF también funciona: el narrador lee la prosa, los personajes los diálogos entre comillas. Pida al node Texto que conserve las frases exactas.
Los bocadillos de una página, uno por línea con el nombre del personaje: el node Voz interpreta la página, y un node Montaje la coloca en pantalla con el sonido.
Duplique el node Voz y cambie solo la voz de un personaje en cada copia: tres tomas, tres timbres, la comparación se hace de oído en un minuto.
Pida al node Texto que traduzca las réplicas y ajuste el idioma del node Voz: ElevenLabs Dialogue interpreta catorce idiomas, con las mismas voces.
El modo diálogo admite diez líneas por toma. Una escena de treinta réplicas son tres nodes Voz, encadenados en un node Montaje con medio segundo de silencio entre tomas.
Dos timbres vecinos suenan como un monólogo. Elija una voz grave y una clara, o una mujer y un hombre, antes de buscar matices más finos.
El narrador debe decir la acción en una frase, no las indicaciones entre paréntesis del guion. La consigna del node Texto lo pide: revise las diez líneas antes de pegarlas.
Porque el modo diálogo lleva sus líneas con una voz cada una, diez como máximo por toma: eso es lo que el modelo interpreta en un solo pase. El node Texto las prepara en el formato correcto, y pegarlas toma diez segundos.
Una veintena de timbres de ElevenLabs, tantos como personajes haya en las diez réplicas. Tres en la demo: narrador, Maren, Elias. Voces de timbres opuestos se distinguen mejor que un monólogo.
Una decena de créditos para diez réplicas: la lectura del PDF por Claude Sonnet 5 y el diálogo de ElevenLabs, facturado por carácter. El precio se muestra en el node antes de hacer clic.
Sí: una voz clonada desde su biblioteca se elige en una línea como cualquier timbre. Clone primero la voz en un node Voz en off, luego asígnela al personaje.
El modelo coloca las respiraciones por sí mismo. Para un silencio real, divida la lectura en dos nodes y deje un segundo entre ambos en el Montaje.
El de las réplicas, ajustado en el node Voz: inglés en la demo, catorce idiomas disponibles. Un guion en español se lee en español, con las mismas voces.
Sí: un node Montaje con la portada o una imagen de la escena como clip, la lectura en la pista de audio, exporta un mp4 para redes sociales o una carpeta de producción.
Hacer leer un guion a varias voces con la IA
Usar este workflowCuenta gratuita, sin tarjeta bancaria. El workflow se abre ya rellenado en tu canvas.