El mensaje de cumpleaños
La foto de la persona festejada, un texto de veinte palabras leído por una voz cálida: es el segundo ejemplo de la demo. El video se envía tal cual por mensaje, y nadie tuvo que filmarse.
Una foto de cara y un texto leído por una voz del catálogo: InfiniTalk hace hablar a la persona, con labios, parpadeos y movimientos de cabeza incluidos. El video dura lo mismo que la voz. Todo el flujo de trabajo se ve sin necesidad de cuenta.
Workflow real, resultados reales. Muévete y haz zoom libremente.
Usar este workflowEl flujo de trabajo real: una foto en un nodo Medio, dos textos leídos cada uno por un nodo Voz en off, y dos nodos Video configurados en InfiniTalk que reciben la foto por el puerto de imagen y la voz por el puerto de voz.
En resumen
Basta con una sola foto. Sin video que grabar, sin avatar que configurar: el rostro de la foto se pone a hablar, con los labios ajustados a cada sílaba, los parpadeos, los pequeños movimientos de cabeza que acompañan una frase. El resultado se ve como una toma frente a cámara, y proviene de un retrato tomado con el teléfono.
El texto se lee en un nodo Voz en off, con una de las voces del catálogo (ElevenLabs v3 a la cabeza) o una voz clonada. El nodo Video configurado en InfiniTalk recibe la foto y la voz, y genera un video que dura exactamente lo mismo que el audio, hasta veintiocho segundos. El precio sigue esa duración, medida sobre el archivo, y se muestra antes de hacer clic.
Es el gesto del avatar que habla, pero a partir de SU rostro, o del de un personaje generado, una mascota dibujada, un retrato antiguo. Un mensaje de cumpleaños, una presentación de producto, un anuncio en redes: la demo muestra dos mensajes sobre la misma foto.
Elija una foto de frente
Rostro nítido, boca cerrada y visible, luz frontal, fondo simple. Un retrato tomado con el teléfono funciona muy bien. Las gafas y las barbas no son problema, una mano delante de la boca o un perfil sí lo son.
Escriba el texto y elija la voz
El nodo Voz en off lee lo que usted escribe con la voz elegida, en su idioma. Una frase de veinte palabras dura entre siete y ocho segundos. Genere la voz primero: es ella la que fija la duración y el precio del video.
Genere el video
El nodo InfiniTalk muestra la duración medida de la voz y el precio exacto. Haga clic: el rostro habla, en 480p para redes sociales o en 720p para una proyección.
Encadene si el texto es largo
Más allá de veintiocho segundos de voz, divida el texto en dos tomas y móntelas una tras otra en un nodo Montaje, de forma gratuita, como en los demás flujos de video.
El mismo canvas, ajustado a necesidades distintas: cada variante son dos o tres líneas de prompt que cambiar.
La foto de la persona festejada, un texto de veinte palabras leído por una voz cálida: es el segundo ejemplo de la demo. El video se envía tal cual por mensaje, y nadie tuvo que filmarse.
Un retrato generado se convierte en presentador: el texto de lanzamiento en el nodo Voz en off, la foto en el nodo Medio, y el video sale en 720p, listo para una página de producto o un anuncio UGC.
Una foto de familia digitalizada, un texto escrito en primera persona: el rostro se anima y habla. Pase primero la foto por un nodo Mejorar si es pequeña o está dañada, y luego por InfiniTalk.
Un personaje dibujado con una boca legible funciona: el modelo anima los labios de un dibujo igual que los de una foto. Ideal para un anuncio de marca en redes sociales, con una voz alegre del catálogo.
Una foto, tres nodos Voz en off en tres idiomas, tres nodos InfiniTalk: la misma persona habla inglés, español y francés, con labios precisos cada vez. Para partir de un video ya grabado, consulte el doblaje.
Tome el video producido y pásela por hacer bailar a una foto o por un nodo Video como referencia: primero el habla, luego el cuerpo.
El modelo necesita ver la boca completa. De frente o en un ligero tres cuartos, la sincronización es limpia; de perfil, los labios se deforman.
Una sonrisa con los dientes visibles, una mano en el mentón, un micrófono delante: son obstáculos. Boca cerrada, rostro despejado, y el resultado es nítido.
El prompt del nodo InfiniTalk describe la actitud, no el texto. Lo que dice la persona es la voz conectada: el texto va en el nodo Voz en off.
Más allá de veintiocho segundos, el nodo se niega a generar, sin ningún cobro. Divida en dos tomas y encadénelas en el nodo Montaje.
De dos a veintiocho segundos por generación, es decir unas sesenta palabras a un ritmo normal. El video dura exactamente lo mismo que la voz conectada: no hay nada que ajustar.
Sí. Importe una grabación en un nodo Medio y conéctela al puerto de voz, o clone su voz en el nodo Voz en off y hágale leer cualquier texto.
Ambos funcionan. Un retrato generado por un nodo Imagen, una mascota dibujada o una foto antigua hablan tan bien como un selfie, siempre que el rostro esté de frente y la boca sea visible.
No. El precio se reserva al lanzar la generación y se devuelve automáticamente en caso de fallo técnico. El importe exacto se muestra en el botón antes de hacer clic.
El avatar que habla genera un presentador inventado con su propia voz, de una sola vez, sobre Veo. Aquí, es SU foto la que habla, con la voz que usted elija, y el texto se cambia sin regenerar el personaje.
Sí, en el nodo Voz en off: las voces de ElevenLabs leen catorce idiomas. La sincronización de labios sigue los sonidos, sea cual sea el idioma.
InfiniTalk genera un encuadre cercano al de la foto, en 480p o 720p. Para un formato preciso, recorte después en el nodo Montaje, que acepta 9:16, 1:1 y 16:9.
Una persona por nodo. Para un diálogo, haga hablar a dos fotos, cada una con su voz, y luego alterne los planos en un nodo Montaje.
Hacer hablar a una foto con IA
Usar este workflowCuenta gratuita, sin tarjeta bancaria. El workflow se abre ya rellenado en tu canvas.