-10 % en la suscripción mensual con el código NODE10, hasta el 31 de agosto

Imaginode
Todas las herramientas

Avatar de IA que habla

Un presentador sintético dice tu guion a cámara, con su voz. Veo 3.1 genera la imagen y el habla a la vez, así que los labios encajan. Visible aquí sin cuenta.

Demo interactiva

Workflow real, resultados reales. Muévete y haz zoom libremente.

Usar este workflow

La ficha de referencia sostiene el rostro, el nodo Texto lleva el guion, el nodo Vídeo entrega ocho segundos con voz. Ningún nodo de voz en off: el habla sale del modelo de vídeo. Abre los nodos para leer los prompts.

En resumen

Lo que produce el workflow
1 imagen en 9:16 · 1 vídeo de 8 s en 720p, formato 9:16
Estructura del canvas
5 nodes conectados por 2 enlaces
Modelos conectados
Seedream 5 Pro, Veo 3.1 Fast
Coste de una pasada completa
unos 149 créditos, es decir 1,49 €

Un avatar que habla choca siempre con el mismo problema: la sincronización labial. Las cadenas clásicas generan un vídeo mudo, fabrican una voz aparte y luego intentan pegar las dos, y queda ese desfase de una décima de segundo que se nota enseguida.

Aquí el habla y la imagen salen del mismo render. Veo 3.1 Fast genera el diálogo con el vídeo: los labios siguen a la voz porque se han calculado juntos. A cambio, cambiar una palabra obliga a relanzar el render, así que el guion se cierra antes de lanzar, y por eso vive en su propio nodo Texto, editable sin tocar el personaje.

El rostro lo sostiene una ficha de referencia de tres ángulos, el mismo mecanismo que para mantener un personaje coherente en varios planos. Así se produce una serie entera con el mismo presentador, episodio tras episodio. Seedream 5 Pro compone el plano de partida, y la calculadora pública da el coste exacto de una toma antes de registrarte.

Cómo hacerlo

  1. 1

    Crea al presentador

    La ficha de referencia lleva tres vistas del rostro. Es lo que permite recuperar exactamente a la misma persona en el episodio siguiente, con otro decorado y otro texto.

  2. 2

    Compón el plano

    El nodo Imagen encuadra la escena: oficina, luz, espacio libre para un texto en pantalla. Un plano de pecho, ligeramente descentrado, deja sitio para los gestos de las manos.

  3. 3

    Escribe la réplica

    El nodo Texto contiene la puesta en escena y la frase que decir, entre comillas. Dos frases cortas bastan para ocho segundos, y el tono se describe como una indicación de interpretación.

  4. 4

    Lanza la toma

    Ocho segundos, formato vertical, audio activado. La voz llega dentro del archivo de vídeo: no hay nada que sincronizar después, ni nada que montar si la toma es buena.

Variantes y casos de uso

El mismo canvas, ajustado a necesidades distintas: cada variante son dos o tres líneas de prompt que cambiar.

Avatar presentador para formación

Un módulo de formación se corta en secuencias de ocho segundos, cada una en su nodo Vídeo, todas conectadas a la misma ficha de cara. El presentador es idéntico de capítulo a capítulo, algo que ninguna serie de tomas reales garantiza a este precio.

Portavoz de marca

La misma cara abre cada vídeo de la empresa, sin depender de la disponibilidad de un empleado ni de su marcha. Describe la ropa y el decorado en el nodo Imagen: la ficha sostiene la cara, el plano sostiene el contexto.

Avatar que habla otro idioma

Escribe la frase entre comillas en el idioma que quieras: Veo 3.1 Fast la pronuncia, labios incluidos. Un mismo vídeo se declina así en cinco mercados, con el mismo presentador y cinco frases.

Vídeo de bienvenida en una página web

Ocho segundos, plano de pecho, oficina desenfocada al fondo: el formato que sube el tiempo de permanencia. Frase corta, una idea por vídeo, y prevé un subtítulo para verlo sin sonido.

Avatar vertical para TikTok y Reels

La plantilla ya renderiza en 9:16. Deja aire por encima de la cabeza para el texto en pantalla y corta el primer medio segundo al montar: los modelos de vídeo suelen arrancar con un plano algo congelado.

Errores frecuentes

Un guion demasiado largo para ocho segundos

Dos frases cortas caben en una toma. Más allá, el modelo acelera o corta el final, y corregir una palabra obliga a pagar el render entero.

Describir la voz después de lanzar el render

La voz sale del mismo render que la imagen: timbre, ritmo e intención se describen en el prompt, antes de generar. Cambiar de voz significa una toma nueva.

Un primer plano muy cerrado

Los planos muy cerrados destacan los micro fallos alrededor de la boca. Un plano de pecho, ligeramente descentrado, deja sitio a las manos y resulta más creíble.

Modelos recomendados

Preguntas frecuentes

¿Se puede elegir la voz?

La describes en el prompt, como una indicación de casting: timbre, ritmo, intención. No se elige de una lista, y dos renders del mismo texto pueden diferir ligeramente.

¿El modelo habla español?

Sí. Escribe la réplica en español entre comillas en el prompt, el resto de la descripción puede quedarse en inglés sin que eso cambie el idioma hablado.

¿Y si la toma sale mal?

Se relanza. Una toma de ocho segundos cuesta unas decenas de céntimos en créditos, y el nodo guarda el historial de los renders anteriores: no se pierde nada al comparar dos versiones.

¿La sincronización labial es correcta?

Sí, porque la imagen y el habla salen del mismo render: no se pega nada después. Eso lo distingue de las cadenas clásicas, donde una décima de segundo de desfase delata el montaje.

¿Puedo usar mi propia cara?

Sí, rellenando la ficha Referencia con tres fotos tuyas. Hazlo solo con la cara de alguien que haya dado su permiso: un portavoz generado a partir de fotos de un tercero es un problema real de derecho a la imagen.

¿Cuánto cuesta una toma de ocho segundos?

Unos 144 créditos con Veo 3.1 Fast, es decir 1,40 euros, imagen de partida incluida. El precio exacto aparece en el botón antes de lanzar el render.

¿Se pueden encadenar varias frases?

Sí, un nodo Vídeo por frase, todos conectados a la misma ficha de cara y al mismo plano de partida. Montados seguidos dan un vídeo de un minuto con un presentador constante.

Avatar de IA que habla

Usar este workflow

Cuenta gratuita, sin tarjeta bancaria. El workflow se abre ya rellenado en tu canvas.