15 de septiembre de 2026
Previz 3D para vídeo con IA: bloquear la escena antes de generar, el método completo
Por qué los cineastas de IA pasan de diez prompts fallidos a una escena 3D ajustada una sola vez, qué debe producir una previz para dirigir Seedance, Kling o Wan, y cómo hacerla en el navegador, sin software 3D, por unos céntimos.

Frank HoubreFundador de Imaginode
El problema que todos conocen: el generador no ve su plano
Un generador de vídeo entiende un movimiento de cámara cuando se le muestra, no cuando se le escribe. La previz 3D fabrica lo que hay que mostrarle.
Tiene el plano en la cabeza. Un travelling bajo que sigue a un personaje por un pasillo, la cámara que se eleva en el momento en que empuja la puerta, la luz que entra. Escribe todo eso en el prompt, lo lanza, y el modelo le devuelve una cámara plantada en el medio, un personaje que camina hacia el objetivo y una puerta que ya no existe. Segundo intento, tercero, décimo. Cada intento cuesta entre 20 y 60 créditos, y aún no tiene la certeza de que el undécimo será el bueno.
No es un problema de vocabulario. Los modelos de vídeo como Seedance 2.5, Kling V3 o Wan 3.0 entienden muy bien «travelling», «contrapicado» o «35 mm». El problema es que esas palabras describen una infinidad de planos posibles, y el modelo elige uno al azar. Lo que elimina la ambigüedad es una imagen de partida, una imagen de llegada y, cuando el modelo la acepta, un vídeo de referencia del movimiento.
Eso es exactamente lo que produce una previz: la versión gris y simplificada de su plano, con volúmenes reales, personajes reales en forma de maniquí y una cámara real, que se ajusta una vez y sirve de referencia para todas las generaciones siguientes. El cine hace esto desde hace treinta años antes de rodar. El vídeo con IA acaba de descubrir que lo necesita aún más.
Qué es una previz, y qué no es
La previz no es un renderizado 3D acabado: es un blocking, volúmenes simples colocados en el lugar correcto, filmados por una cámara con los valores correctos.
En la producción clásica, la previsualización (previz para todos) es la etapa en la que se construye el plano en 3D antes de rodarlo. Sin texturas, sin actores, sin decorados detallados: cajas para las paredes, cilindros para las columnas, maniquíes para el reparto. Lo que importa está en otro lado: dónde está la cámara, qué distancia focal, a qué altura, qué movimiento, a qué velocidad, y quién está dónde en el encuadre en cada segundo.
Todo lo que es gris en una previz es voluntariamente gris. El día en que se ponen texturas, se empieza a discutir la textura en lugar del encuadre. La previz sirve para resolver las cuestiones de puesta en escena, y las resuelve mejor cuando aún no se parece a la película.
Para el vídeo con IA, la previz tiene una función más: genera archivos que el generador sabe leer. Una imagen nítida del primer encuadre, una imagen nítida del último, un vídeo de unos segundos donde se ve exactamente el movimiento, y una descripción del plano escrita en los términos que los modelos entienden. Ya no es una herramienta de discusión, es la mitad del prompt.
Las cuatro cosas que una previz debe darle
Imagen de partida, imagen de llegada, vídeo de referencia, prompt estructurado: con estos cuatro archivos, la generación se convierte en una ejecución, no en una lotería.
La imagen de partida fija el encuadre del primer segundo. Todos los modelos de imagen a vídeo la aceptan: es la garantía de que el plano empieza exactamente donde usted lo decidió, con el personaje correcto en el lugar correcto. La imagen de llegada, aceptada por Seedance, Kling y Wan, fija el último segundo. Entre ambas, al modelo solo le queda interpolar un movimiento coherente, algo que hace bien.
El vídeo de referencia es el renderizado gris de la previz, tal cual. Algunos modelos lo toman como referencia de movimiento: Kling 3.0 Motion Control reproduce el gesto y la trayectoria de un vídeo sobre el personaje de una imagen. Ahí, la cámara que usted dibujó se convierte literalmente en la cámara del renderizado. Para los demás modelos, sirve como referencia visual y como verificación: se compara el resultado con la previz, plano por plano.
El prompt estructurado, por último, describe el plano en términos cinematográficos: duración, ratio, posición inicial de la cámara respecto al sujeto, altura, distancia focal y su sensación (gran angular, retrato), movimiento (travelling de tantos metros a tal velocidad, subida de tanto, panorámica de tantos grados), qué hacen los personajes, el ambiente y las luces. Escrito a mano, ese párrafo lleva veinte minutos y contiene errores. Generado desde la escena, es exacto, porque se calcula.
Todo cabe en una carpeta zip que el estudio 3D Previz de Imaginode exporta con un clic, con los metadatos de la cámara en JSON para quienes quieran ir más allá. La guía del estudio detalla cada archivo.
Hacer su previz en el navegador, sin software 3D
Una frase basta para obtener una escena, el ratón hace el resto, y el renderizado es gratis: la previz deja de estar reservada a quienes saben animar en Blender.
Hasta ahora, hacer una previz significaba abrir Blender, Unreal o Cinema 4D, modelar volúmenes, aparejar una cámara y aprender a animar fotogramas clave. Semanas de curva de aprendizaje para alguien que solo quiere decidir un encuadre. El 3D Previz de Imaginode le da la vuelta al problema: usted describe la escena en una frase, con imágenes de referencia si las tiene, y un director de IA la construye en 3D en su navegador.
Concretamente, «un pasillo de hospital de noche, un enfermero que camina hacia una puerta al fondo, cámara baja detrás de él» produce un pasillo, puertas, un maniquí con nombre, una luz fría, una cámara de 35 mm colocada a 80 cm del suelo detrás del personaje. No es una imagen generada: es una escena editable, donde cada elemento se puede seleccionar, desplazar y ajustar. La construcción cuesta a partir de 5 créditos, 12 de media (un crédito equivale a un céntimo), y el precio se muestra antes de hacer clic, como en todo Imaginode.
Después, se ajusta. Se selecciona la cámara, se elige la distancia focal de 14 a 135 mm, se aplica uno de los 25 movimientos (travelling de avance, grúa, órbita, revelación, vertigo, cámara al hombro) o se dibuja el recorrido clic tras clic sobre el suelo. Se grava una cámara virtual a mano, en modo vuelo, y luego se suaviza. Se coloca la imagen de inicio y la imagen final. Se le pide al director de IA «retrocede la cámara dos metros y pasa a 50 mm» cuando se prefiere hablar en lugar de hacer clic.
Y se exporta: imagen, vídeo mp4 codificado directamente en el navegador, tira de contacto, storyboard de todos los planos, paquete para IA. No se consume ningún crédito para todo esto. La previz del pájaro y el globo aerostático que ilustra la página del estudio se renderizó así: 27 segundos de persecución en una sola toma, exportados en 1080p en pocos segundos.
Del blocking al renderizado: el recorrido en el lienzo
La previz vive en el mismo proyecto que la generación: las imágenes exportadas se convierten en las entradas de un node Vídeo, sin pasar por el disco.
El recorrido completo se resume en cuatro pasos. Uno, describir la escena y dejar que el director de IA la bloquee. Dos, ajustar el plano o los planos: cámara, distancia focal, movimiento, posición de los personajes en la línea de tiempo. Tres, exportar el paquete para IA del plano. Cuatro, en el lienzo de Imaginode, conectar la imagen de partida y la imagen de llegada a un node Vídeo, pegar el prompt estructurado, elegir el modelo y generar.
Para elegir el modelo, la regla es sencilla. Un plano en el que la cámara se mueve mucho y el personaje tiene un gesto preciso va hacia Kling 3.0 Motion Control con el vídeo de referencia. Un plano en el que el encuadre importa más que el gesto va hacia Seedance 2.5 con imagen de partida e imagen de llegada, o hacia Wan 3.0 para planos largos de hasta 30 segundos. Nuestra guía dirigir la cámara de un generador de vídeo con IA compara el comportamiento modelo por modelo.
Un detalle que lo cambia todo: la previz no se vuelve a hacer. Si el primer renderizado no es bueno, usted cambia de modelo o ajusta el prompt, pero la escena, la cámara y las imágenes se mantienen. Ya no se parte de cero en cada intento, y ahí es donde se ahorran créditos.
Cuánto cuesta, comparado con el método de «diez prompts»
Una previz cuesta una docena de créditos una vez; cada generación de vídeo evitada ahorra entre veinte y sesenta.
Tomemos un plano de 10 segundos en 1080p. En el lienzo, una generación con Seedance 2.5 se sitúa alrededor de 60 créditos, Kling V3 un poco por debajo, Wan 3.0 por encima según la resolución; la calculadora da los valores exactos del día. Diez intentos para llegar al encuadre deseado son 400 a 600 créditos, es decir, 4 a 6 euros, para un solo plano.
Con una previz, la escena cuesta una docena de créditos, los ajustes por mensaje dos o tres, el renderizado y las exportaciones nada. Después se genera una o dos veces en lugar de diez. En una película de veinte planos, la diferencia se cuenta en decenas de euros y en horas de espera evitadas. Y el argumento que más cuenta no es el precio: es que el encuadre final es el que usted había decidido.
Higgsfield lanzó el 4 de septiembre de 2026 una herramienta de escena 3D por prompt, 3D Jutsu, mediante suscripción. Lo analizamos de cerca en este artículo: los dos enfoques se parecen en el principio, y se diferencian en el precio, la integración con el generador y el control de cámara.
Cinco errores de previz que cuestan caro después
Una previz útil es sobria, a escala, y pensada para el modelo que la va a leer.
Primer error: querer que la previz sea bonita. Debe ser legible. Bastan volúmenes grises y un maniquí; una escena cargada de detalles hace que el movimiento de cámara sea menos visible en el vídeo de referencia, y el modelo se aferra a detalles que no tienen sentido.
Segundo: olvidar la escala. Un maniquí mide 1,75 m, una puerta 2,10 m, un coche 4,5 m. Si las proporciones son incorrectas, la distancia focal engaña, y el resultado parecerá una maqueta. El kit de blocking de Imaginode coloca cada objeto en su tamaño real, y la colocación inteligente lo apoya en el suelo.
Tercero: una cámara que lo hace todo a la vez. Un travelling, una subida, una panorámica y un zoom en el mismo plano de 8 segundos, ningún modelo lo sigue. Un movimiento principal por plano, dos como máximo. Los 25 presets del estudio están ahí para eso.
Cuarto: descuidar la imagen final. Es la que impide que el modelo se desvíe en la segunda mitad del plano, y es lo primero que se olvida exportar. Quinto: no nombrar a los personajes. Un maniquí llamado «Lea» en la escena se convierte en «Lea» en el prompt estructurado, y usted puede vincularle su personaje de referencia en el lienzo.
Por dónde empezar
Un plano, una frase, una exportación: en diez minutos sabrá si el método le conviene.
Elija un plano que nunca haya logrado conseguir con el prompt. Abra el 3D Previz, descríbalo en una frase, deje que la escena se construya. Ajuste la cámara con el ratón hasta que la vista incrustada muestre el encuadre que tenía en mente, coloque la imagen de inicio y la imagen final, exporte el paquete.
Luego genere una sola vez en el lienzo, con el modelo adecuado. Compare con el renderizado gris. Si el plano está ahí, acaba de ahorrarse nueve generaciones. Si no, sabrá exactamente qué se desvió, porque tiene una referencia al lado. Eso es la previz: una referencia contra la que juzgar, en lugar de un recuerdo de lo que quería.