El pipeline completo de un canal divulgativo: un tema de entrada, un guion escrito por un modelo de lenguaje, una voz en off, tres planos y un montaje de diez segundos. Visible aquí sin cuenta.
Demo interactiva
Workflow real, resultados reales. Muévete y haz zoom libremente.
El flujo completo está aquí: el nodo Texto escribe el guion, la voz en off lo lee, la dirección artística sostiene los tres planos, el nodo Vídeo entrega el montaje. Muévete, haz zoom, abre los nodos.
En resumen
Lo que produce el workflow
3 imágenes en 16:9 · 1 vídeo de 10 s en 720p, formato 16:9 · 1 voz en off
Estructura del canvas
10 nodes conectados por 7 enlaces
Modelos conectados
Kimi K2.5, OpenAI TTS HD, Seedream 5 Pro, Seedance 2.0
Coste de una pasada completa
unos 139 créditos, es decir 1,39 €
Un canal sin rostro vive de una cosa: producir rápido, a menudo, sin filmarse nunca. Un único campo de texto no basta, porque un vídeo así no es una imagen animada sino una cadena de producción: un tema, un texto, una voz, planos, un montaje. Este flujo muestra los cinco eslabones uno al lado del otro, y es exactamente lo que recibes al abrir la plantilla.
El nodo Texto del guion es el único del producto que lleva un modelo de lenguaje: escribes un tema, devuelve el texto de la voz en off, y ese mismo texto entra en el nodo Voz. Nada que copiar entre dos herramientas, y nada que rehacer cuando cambia el tema. La voz en off se queda en su propio nodo en lugar de dentro del vídeo: se vuelve a generar tantas veces como quieras sin volver a pagar el montaje.
El primer nodo Texto contiene una línea: el tema del vídeo. Es el único sitio que hay que cambiar cuando produces el episodio siguiente.
2
Deja que se escriba el guion
El segundo nodo Texto lleva un modelo de lenguaje y una instrucción de redacción. Cuenta unas treinta palabras por diez segundos: más allá, la voz corre detrás de las imágenes.
3
Fija la dirección artística
El nodo Dirección artística describe la materia, la paleta y la luz una sola vez, y alimenta los tres planos. Sin él, las tres imágenes no parecen del mismo vídeo.
4
Monta en un solo render
El prompt de vídeo describe cuatro planos numerados, cortes secos, dos segundos y medio cada uno. El montaje sale mudo: la voz en off se pone encima y sigue siendo editable aparte.
Variantes y casos de uso
El mismo canvas, ajustado a necesidades distintas: cada variante son dos o tres líneas de prompt que cambiar.
Canal de misterio y casos reales
El nicho más denso del faceless: un caso sin resolver, una desaparición, un enigma. El nodo Texto del guion escribe la narración a partir del tema, la voz en off la lee, y los tres planos muestran lugares antes que personas. Las caras son lo que antes delata un vídeo generado.
Divulgación científica
La misma cadena con otro tono: una pregunta al abrir, una explicación en tres tiempos, una conclusión. Relee siempre lo que escribe el modelo de lenguaje antes de generar la voz: en un tema técnico afirma cosas falsas con el mismo aplomo.
Shorts verticales con el mismo guion
El guion vive en su nodo: duplica el nodo Vídeo en 9:16, deja tres planos en vez de cinco, y tienes el formato corto sin reescribir una línea. Es la principal ventaja de un canvas frente a un generador de un solo campo.
Vídeo faceless en otro idioma
Escribe el tema en el idioma que quieras: el modelo de lenguaje redacta en él y OpenAI TTS HD lo lee correctamente. El mismo canvas produce así una versión por mercado, con los mismos planos y otra voz en off.
Serie con ritmo de publicación fijo
Un canal faceless vive de la regularidad. Guarda un canvas por serie: solo cambia el nodo Tema de un episodio a otro, la dirección artística y la voz se quedan, y la identidad visual se construye sola.
Errores frecuentes
Generar la voz antes de releer el guion
Una voz en off hecha sobre un texto sin revisar se rehace entera por una palabra. Relee primero, genera después: la voz vive en su propio nodo justamente para rehacerse sola.
Tres planos sin dirección artística común
Sin el nodo Estilo conectado a las tres imágenes, el vídeo parece tres vídeos distintos pegados. Es el defecto que hace abandonar a los cuatro segundos.
Un guion de ochenta palabras para diez segundos
Cuenta treinta palabras por diez segundos. Un guion largo da una voz acelerada, y el montaje va por detrás de la narración de principio a fin.
¿Por qué la voz en off no se genera dentro del vídeo?
Porque una voz incrustada en el render obliga a pagar todo el vídeo otra vez para cambiar una palabra. En su propio nodo cuesta unos céntimos rehacerla, y es ella la que marca la duración de los planos.
¿Cuánto cuesta un vídeo así?
Tres imágenes, una voz en off y un montaje de diez segundos rondan el euro y medio en créditos. El desglose modelo a modelo está en la calculadora.
¿Se puede pasar de diez segundos?
Sí, encadenando varios nodos Vídeo en el mismo lienzo, cada uno partiendo de la última imagen del anterior. La plantilla muestra uno para que se lea bien, el mecanismo es el mismo más allá.
¿Se puede monetizar un canal faceless en YouTube?
Sí, siempre que aportes algo propio: guion original, montaje, voz, punto de vista. YouTube penaliza el contenido repetitivo y poco auténtico, no la ausencia de cara ni el uso de herramientas de generación.
¿Qué modelo de lenguaje escribe el guion?
El nodo Texto de la plantilla lleva Kimi K2.5, a un crédito por generación. Cualquier otro modelo de lenguaje del catálogo puede sustituirlo en el mismo nodo.
¿Se puede producir un vídeo al día?
Sí: una vez montado el canvas, un episodio es cambiar el tema y volver a lanzar, unos diez minutos y alrededor de 1,40 euros de créditos por diez segundos montados.
¿Hay que declarar que el vídeo está generado con IA?
YouTube pide señalar el contenido sintético realista que pueda inducir a error, con la casilla prevista al subir el vídeo. Un documental ilustrado con imágenes generadas se declara, y eso no afecta ni a la monetización ni al alcance.