Blog

12 de agosto de 2026

Primer vídeo con IA: el método para no reventar tu presupuesto

Un vídeo IA cuesta entre 26 y 330 créditos según el modelo y la resolución. Aquí tienes cómo validar tu plano en imagen por 1 a 7 créditos antes de animar nada, ajustar duración y resolución con cabeza, y evitar los errores que vacían una cuenta en una sola tarde.

la trampa del primer intento

La escena es un clásico. Un viernes por la noche, con una idea de clip en la cabeza, abres un generador de vídeo, escribes «un caballero atraviesa un bosque brumoso al amanecer» y haces clic en Generar. Tres minutos de espera. Llega el resultado: el caballero está de espaldas, el bosque parece un parque municipal y la bruma ha desaparecido. Veintiséis créditos volatilizados, y ni siquiera tienes un plano utilizable.

El problema no es el modelo. Kling 2.5 Turbo, que produjo ese caballero fallido, es un generador excelente. El problema es el método: en texto a vídeo directo, pagas la tarifa completa de una animación para descubrir una composición que podrías haber validado en imagen fija por un céntimo. Es como imprimir un libro entero para releer el primer capítulo.

Este artículo detalla el método inverso, el que usan los creadores que aguantan un mes con una suscripción Starter de 13 €: validar cada plano en imagen, y luego animar esa imagen. Con las cifras reales, los fallos reales, y lo que Imaginode reembolsa y lo que no.

cuánto cuesta de verdad una generación de vídeo

Pongamos los órdenes de magnitud sobre la mesa, porque todo el razonamiento sale de ahí. En Imaginode, 1 crédito vale alrededor de 0,01 €. Kling 2.5 Turbo cobra unos 26 créditos por 5 segundos, es decir, 0,26 €. Seedance 2.0 Fast sube a unos 48 créditos por 5 segundos en 720p. Y Seedance 2.0 completo, en 4K, alcanza unos 330 créditos por 5 segundos: más de 3 € el clip.

Enfrente, una imagen cuesta entre 1 crédito (Flux Schnell) y 7 créditos (Flux 2 Pro). Dicho de otro modo, un solo vídeo fallido equivale a 4 o 5 exploraciones completas en imagen, con una decena de intentos cada una. Esa proporción de 1 a 30, a veces de 1 a 300, es la única estadística que recordar antes de hacer clic en Generar.

Existe una barrera de seguridad: el coste exacto aparece en el botón Generar antes de hacer clic. Sin sorpresas en la facturación, el precio está escrito negro sobre blanco en el momento de decidir. Acostúmbrate a leerlo. Muchos principiantes descubren a posteriori que lanzaron un modelo de gama alta por puro reflejo.

por qué el texto a vídeo directo es una apuesta

Cuando envías un prompt directamente a un modelo de vídeo, le delegas todo: el encuadre, la luz, la cara del personaje, la paleta de colores y el movimiento. Cinco decisiones de golpe, descubiertas después de pagar. Estadísticamente, basta con que una sola salga mal para que el plano sea inutilizable.

Y hay que decirlo con franqueza: el vídeo IA todavía falla a menudo. Cuenta con que una generación de cada tres o cuatro acaba en la papelera, por manos deformes, textos que se derriten en pantalla o una física dudosa, el típico vaso que atraviesa la mesa. En un intento de 48 créditos, cada fallo pesa. Con tres intentos directos ya has gastado 144 créditos por, quizá, dos planos correctos.

Otro punto que conocer antes de empezar: un resultado feo pero técnicamente entregado se paga igual. Solo se reembolsan los fallos técnicos del proveedor. La plataforma no juzga la estética de tu caballero, únicamente comprueba que el archivo existe. De ahí el interés de reducir al máximo lo que el modelo de vídeo puede estropear.

el método: validar primero en imagen

El principio cabe en una frase: nunca le pidas a un modelo de vídeo que invente una composición, pídele que anime una imagen que ya has aprobado. En el canvas de Imaginode, añade un nodo Imagen, escribe tu prompt, genera. El resultado está ahí en unos segundos, por 1 a 7 créditos según el modelo.

¿No te convence la imagen? Modifica el prompt y vuelve a lanzar. Cada nodo conserva el historial de sus 12 últimas generaciones, así que puedes comparar las versiones una junto a otra y volver a la tercera si la octava es peor. Es un lujo que no tienes en vídeo, donde cada comparación costaría 26 créditos como mínimo.

Cuando la imagen es exactamente la que quieres, encuadre incluido, se convierte en el primer fotograma de tu vídeo. Al modelo de vídeo solo le queda un trabajo: hacer que se mueva lo que ya existe. Acabas de transformar una apuesta con cinco incógnitas en una apuesta con una sola.

qué modelo de imagen para ese primer fotograma

Para desbrozar, Flux Schnell a 1 crédito es imbatible. Diez pruebas de composición cuestan 10 créditos, es decir, 0,10 €. Es el borrador desechable por excelencia: rápido, no siempre fino en los detalles, pero suficiente para juzgar un encuadre y una luz sin arruinarse.

Una vez encontrada la composición, regenera la versión final con un modelo más cuidado: Flux Pro 1.1 o Imagen 4 a 6 créditos, o Flux 2 Pro a 7 créditos si quieres el máximo de detalle. Si tu plano pone en escena a un personaje recurrente definido en un nodo Referencia, Seedream 5 Lite, a 5 créditos, es el campeón del respeto a las referencias.

Balance de una exploración seria: unos quince créditos, borradores incluidos. Más barato que un solo vídeo Kling fallido. Y llegas a la etapa de animación con una certeza que el texto a vídeo directo nunca te dará: ya sabes qué aspecto tendrá tu plano.

conectar la imagen al nodo Vídeo

En el canvas, tira de un cable desde el puerto de salida del nodo Imagen hasta el nodo Vídeo. El punto de entrada se ilumina al conectarse, señal de que el enlace está activo. Si sueltas el cable en cualquier parte del nodo, se conecta solo a la entrada más probable, en este caso la imagen de inicio.

El nodo Vídeo muestra entradas distintas según el modelo elegido. La imagen de inicio, siempre única, fija el primer fotograma. Algunos modelos aceptan también una imagen final, práctica para transiciones controladas. Y las imágenes de referencia mantienen a tus personajes coherentes: hasta 9 en Seedance 2.0, más en Seedance 2.5.

Con una imagen de inicio conectada, la composición, la luz y la cara quedan bloqueadas. La tasa de planos utilizables sube claramente respecto al texto solo, porque el modelo ya solo puede equivocarse en el movimiento. Un detalle de paso: Seedance en imagen a vídeo impone sus propias restricciones de resolución, y la plataforma lo ajusta por ti.

empieza en 5 segundos y 720p, sube después

La duración y la resolución son las dos palancas que hacen estallar los presupuestos. Ajústalas al mínimo para validar, al máximo para entregar. En concreto: 5 segundos en 720p para todas tus pruebas de movimiento. Es de sobra para juzgar si el caballero camina con naturalidad o si se desliza por el suelo como un peón de ajedrez.

La diferencia de precio justifica la disciplina. En Seedance 2.0, el mismo plano de 5 segundos pasa de unos 48 créditos en 720p Fast a unos 330 créditos en 4K con el modelo completo. Casi siete veces más caro para una prueba cuyo resultado quizá tires a la basura. El 4K es para la versión final, la que exportas.

Misma lógica para la duración. Seedance 2.5 acepta clips de hasta 30 segundos, lo cual es notable, pero un fallo de 30 segundos cuesta seis veces un fallo de 5 segundos. Trocea tus escenas en planos cortos, valídalos uno a uno, y reserva los planos largos para los movimientos ya probados.

qué modelo de vídeo para empezar

Imaginode da acceso a 47 modelos, todos pagados con los mismos créditos, lo que permite cambiar de proveedor en dos clics sin nueva suscripción. Para una primera tarde, dos valores seguros. Kling 2.5 Turbo, unos 26 créditos por 5 segundos, es la mejor relación calidad-precio para aprender: rápido, movimiento natural, suficiente para juzgar tus ideas. Seedance 2.0 Fast, unos 48 créditos, entrega texturas más finas.

Los demás nombres del catálogo llegarán después. Veo 3.1 Lite y Fast cuando quieras audio generado, Seedance 2.0 completo para subir a 1080p o 4K, Seedance 2.5 para las referencias múltiples y los clips de hasta 30 segundos. Grok Imagine Video, MiniMax H3, Wan 2.7, Kling V3 o PixVerse tienen cada uno sus puntos fuertes, pero ninguno es imprescindible para un primer clip.

Nuestro consejo, sin rodeos: quédate en un solo modelo mientras aprendes. Cada generador tiene sus manías, su forma de interpretar un travelling o una luz, y solo progresarás acumulando intentos comparables. Cambiar de modelo en cada plano es volver a empezar de cero en cada plano, y pagar el aprendizaje varias veces.

describir el movimiento, no la imagen

Tu imagen ya lleva la composición, así que no la repitas en el prompt de vídeo. Describe únicamente lo que se mueve: el sujeto, la cámara, el ritmo. «El caballero avanza despacio hacia la cámara, su capa ondea al viento, caen hojas en primer plano.» Una frase de movimiento clara vale más que un párrafo de descripción redundante.

Formula el movimiento de cámara como frase final explícita: los modelos responden mejor a eso que a un adjetivo perdido en medio del texto. Y sé modesto con la cantidad: un sujeto que se mueve más un movimiento de cámara ya es mucho para 5 segundos. Los prompts que apilan cuatro acciones producen papillas visuales.

Si el inglés técnico te frena, la varita mágica del campo de prompt reescribe tu texto en un inglés rico y estructurado a través del modelo Kimi, por 1 crédito. Conserva tus @menciones de personajes. Un crédito para afianzar una generación de 48: las cuentas salen solas.

lo que todavía falla, honestamente

Ningún método hace infalible al vídeo IA, y afirmar lo contrario sería mentirte. Incluso con una imagen de inicio limpia, cuenta con un fallo cada tres o cuatro generaciones. Las manos siguen siendo el punto débil número uno: dedos fusionados, pulgares de más, objetos sujetados que se deforman por el camino.

El texto en pantalla es el otro cementerio clásico. Un rótulo legible en tu imagen de inicio tiene muchas papeletas de fundirse en jeroglíficos en el segundo dos de la animación. Y la física sigue siendo aproximada: líquidos que desafían la gravedad, pasos de personajes que patinan, objetos que se atraviesan entre sí.

La defensa está sobre todo en la elección de los planos. Evita los primeros planos de manos en acción, el texto que debe seguir siendo legible, las interacciones complejas de objetos como servir un café. Prioriza las caras, las caminatas, los ambientes, los movimientos de cámara sobre un decorado. Un buen realizador IA elige sus batallas, exactamente igual que un director sin presupuesto elige las escenas que puede rodar.

reembolsado cuando se rompe, pagado cuando es feo

La regla merece quedar cristalina porque estructura tu presupuesto. Si la generación falla técnicamente en el proveedor del modelo, servidor caído, archivo nunca entregado, tus créditos vuelven automáticamente a tu cuenta en unos segundos. Nada que pedir, nada que justificar, ningún formulario de reclamación.

En cambio, un vídeo entregado pero decepcionante se factura igual. El caballero bizco, la capa que flota raro: está entregado, luego pagado. Esta asimetría no es una estafa, es el funcionamiento de todos los proveedores de modelos: el cálculo se ha ejecutado de verdad. Pero explica por qué todo el método de este artículo apunta a reducir las generaciones decepcionantes en lugar de esperar reembolsos.

Presupuesta en consecuencia: para un plano final, prevé dos o tres generaciones de vídeo, no una. Un plano Kling validado a la primera por 26 créditos es una buena sorpresa, no una hipótesis de trabajo. Con 2,5 generaciones de media, tu plano de 5 segundos sale por unos 65 créditos, es decir, 0,65 €.

tres errores de principiante que cuestan créditos

Primer error: animar a un personaje recurrente sin imágenes de referencia. Sin ellas, la cara cambia de una generación a otra, y quemas créditos persiguiendo un parecido que el modelo no tiene forma alguna de conocer. Crea un nodo Referencia con un nombre, una descripción y algunas fotos, y luego @menciónalo en el prompt: la descripción se inyecta y las fotos se adjuntan automáticamente.

Segundo error: relanzar en bucle el mismo prompt esperando un milagro. Si dos generaciones consecutivas fallan en el mismo punto, el problema está en la petición, no en la tirada. Cambia algo concreto, una acción menos, un movimiento más simple, antes de volver a pagar 26 créditos. El historial del nodo te muestra exactamente qué se ha intentado ya.

Tercer error: lanzar directamente la versión definitiva en alta resolución. El reflejo de «mejor hacerlo bien a la primera» cuesta unos 330 créditos por intento en 4K con Seedance 2.0, cuando la validación en 720p cuesta 48. Hazlo bien a la primera en 720p, y luego regenera una sola vez en grande.

el audio generado, el caso Veo

Algunos modelos ya no se conforman con la imagen. Veo 3.1 Lite y Fast generan también la banda sonora: ambiente, efectos, a veces diálogos. Un plano de lluvia llega con el sonido de la lluvia, un mercado con su rumor de multitud. Kling V3 también ofrece audio. Para formatos cortos destinados a redes, eso ahorra una sesión de diseño de sonido.

El coste sube, lógicamente, cuando el audio está activado, y la tarifa exacta aparece como siempre en el botón Generar. Hazte la pregunta antes de cada plano: si tu clip va a acabar montado bajo una música, el audio generado irá a la papelera. Pagar más caro por una pista que vas a cortar no tiene ningún sentido.

Nuestra opinión, sin rodeos: el audio generado brilla en los planos de ambiente y las escenas habladas simples, y todavía decepciona en todo lo que exige una sincronización precisa. Pruébalo en un plano, escucha, decide. Es el tipo de arbitraje que se hace de oído, no sobre una ficha técnica.

progresar con el nodo Cámara

Una vez adquirido el método de imagen y luego vídeo, el nodo Cámara es tu siguiente escalón. Cinco ruedas ilustradas, encuadre, objetivo en milímetros, apertura, ángulo, movimiento, y el nodo escribe por ti los términos ingleses correctos al principio del prompt, allí donde los modelos ponderan con más fuerza.

El interés para el vídeo es directo: la rueda de movimiento propone cámara fija, travelling hacia delante o hacia atrás, panorámica, grúa ascendente, órbita, cámara en mano o zoom lento, y lo inscribe como frase final explícita de tu prompt. Se acabaron los «cinematic camera movement» vagos que no producen nada preciso.

Un mismo nodo Cámara puede alimentar varios generadores a la vez, lo que mantiene una realización coherente entre el plano de apertura y el siguiente. Le dedicamos un artículo entero, «Dirigir la IA como un director de fotografía», con los efectos concretos de cada ajuste. Empieza simple: un plano medio, un 35 mm, un travelling de avance lento.

un presupuesto tipo para una primera tarde

Pongamos cifras a una sesión real de descubrimiento, la de un creador que quiere tres planos de 5 segundos para un teaser. Exploración de composiciones en Flux Schnell: una treintena de imágenes, 30 créditos. Versiones finales de las tres imágenes en Flux Pro 1.1: 18 créditos. Animación en Kling 2.5 Turbo con dos intentos por plano de media: unos 156 créditos. Total: aproximadamente 205 créditos, es decir, unos 2 €.

Con el plan Starter, a 13 € sin IVA y sus 900 créditos mensuales, esa tarde representa menos de un cuarto del presupuesto del mes. Un creador regular que encadena clips pasará al plan Creador, 42 € sin IVA por 3 100 créditos. Y para un pico puntual, las recargas empiezan en 1 000 créditos por 15 €.

Compara con el método ingenuo: tres planos en texto a vídeo directo con Seedance 2.0 Fast, con la tasa de fallo habitual, habrían consumido de 400 a 500 créditos para un resultado menos controlado. El método no solo cuesta menos, produce mejor. El código SIMPLE15 rebaja además la factura un 15 % en las suscripciones.

y ahora, tu primer plano

Resumamos los pasos para esta misma noche. Un nodo Imagen, diez borradores con Flux Schnell, una versión final limpia. Un cable hacia un nodo Vídeo, Kling 2.5 Turbo o Seedance 2.0 Fast, 5 segundos, 720p. Una frase de movimiento clara. Todo se guarda automáticamente, y hasta puedes lanzar la generación desde el navegador de tu móvil: continúa con la pantalla bloqueada.

Si prefieres partir de una base ya montada, las plantillas listas para usar incluyen cadenas de imagen a vídeo ya cableadas: sustituyes los prompts y todo lo demás está en su sitio. Y el asistente, en la burbuja de abajo a la derecha, puede construir el workflow completo por ti por 1 crédito por mensaje, viendo tu canvas abierto.

Para ir más allá de este primer plano, la academia integrada en la documentación ofrece cursos en vídeo de YouTube que repasan toda la cadena mostrándola en pantalla. Próxima parada recomendada en este blog: el artículo sobre el nodo Cámara, porque un plano que se mueve bien es, antes que nada, un plano bien encuadrado.

¿Quieres probarlo en un canvas real?

Todo lo descrito en este artículo se hace en Imaginode, en tu navegador.

Empezar