12 de agosto de 2026
Primeiro vídeo com IA: o método para não explodir seu orçamento
Um vídeo de IA custa entre 26 e 330 créditos, dependendo do modelo e da resolução. Veja como validar seu plano em imagem por 1 a 7 créditos antes de animar qualquer coisa, ajustar duração e resolução com inteligência, e evitar os erros que esvaziam uma conta numa única noite.
a armadilha da primeira tentativa
A cena é clássica. Uma sexta à noite, uma ideia de clipe na cabeça, você abre um gerador de vídeo, digita "um cavaleiro atravessa uma floresta enevoada ao nascer do sol" e clica em Gerar. Três minutos de espera. O resultado chega: o cavaleiro está de costas, a floresta parece um parque municipal, a névoa desapareceu. Vinte e seis créditos evaporados, e você não tem nem um plano utilizável.
O problema não é o modelo. O Kling 2.5 Turbo, que produziu esse cavaleiro fracassado, é um excelente gerador. O problema é o método: no texto-para-vídeo direto, você paga a tarifa cheia de uma animação para descobrir uma composição que poderia ter validado em imagem estática por um centavo. É como imprimir um livro inteiro para reler o primeiro capítulo.
Este artigo detalha o método inverso, aquele que usam os criadores que atravessam um mês inteiro com uma assinatura Starter de 13 €: validar cada plano em imagem, e depois animar essa imagem. Com os números reais, os fracassos reais, e o que o Imaginode reembolsa ou não.
quanto custa de verdade uma geração de vídeo
Vamos estabelecer as ordens de grandeza, porque todo o raciocínio nasce delas. No Imaginode, 1 crédito vale cerca de 0,01 €. O Kling 2.5 Turbo cobra em torno de 26 créditos por 5 segundos, ou seja, 0,26 €. O Seedance 2.0 Fast sobe para uns 48 créditos por 5 segundos em 720p. E o Seedance 2.0 completo, em 4K, chega a cerca de 330 créditos por 5 segundos: mais de 3 € o clipe.
Do outro lado, uma imagem custa entre 1 crédito (Flux Schnell) e 7 créditos (Flux 2 Pro). Em outras palavras, um único vídeo fracassado equivale a 4 ou 5 explorações completas em imagem, com uma dezena de tentativas cada uma. Essa proporção de 1 para 30, às vezes de 1 para 300, é a única estatística que você precisa lembrar antes de clicar em Gerar.
Existe uma proteção: o custo exato aparece no botão Gerar antes do clique. Nada de surpresa na cobrança, o preço está escrito com todas as letras no momento da decisão. Crie o hábito de ler. Muitos iniciantes descobrem depois do fato que dispararam um modelo de ponta no reflexo.
por que o texto-para-vídeo direto é uma aposta
Quando você envia um prompt diretamente a um modelo de vídeo, você delega tudo a ele: o enquadramento, a luz, o rosto do personagem, a paleta de cores e o movimento. Cinco decisões de uma vez, descobertas depois do pagamento. Estatisticamente, basta uma única dar errado para o plano ficar inutilizável.
E é preciso dizer com franqueza: o vídeo com IA ainda erra bastante. Conte cerca de uma geração a cada três ou quatro indo para o lixo, por causa de mãos disformes, de textos que derretem na tela ou de uma física duvidosa, aquele tipo de copo que atravessa a mesa. Numa tentativa de 48 créditos, cada fracasso pesa. Em três tentativas diretas, você gastou 144 créditos por talvez dois planos aceitáveis.
Outro ponto para conhecer antes de começar: um resultado feio mas tecnicamente entregue continua pago. Só as falhas técnicas do lado do fornecedor são reembolsadas. A plataforma não julga a estética do seu cavaleiro, ela só verifica se o arquivo existe. Daí o interesse de reduzir ao máximo o que o modelo de vídeo tem chance de errar.
o método: validar em imagem primeiro
O princípio cabe numa frase: nunca peça a um modelo de vídeo para inventar uma composição, peça a ele para animar uma imagem que você já aprovou. No canvas do Imaginode, adicione um nó Imagem, escreva seu prompt, gere. O resultado aparece em poucos segundos, por 1 a 7 créditos dependendo do modelo.
A imagem não agradou? Modifique o prompt e rode de novo. Cada nó conserva o histórico das suas 12 últimas gerações, então você pode comparar as versões lado a lado e voltar à terceira se a oitava for pior. É um luxo que não existe em vídeo, onde cada comparação custaria no mínimo 26 créditos.
Quando a imagem for exatamente a que você quer, enquadramento incluído, ela vira o primeiro frame do seu vídeo. O modelo de vídeo passa a ter um único trabalho: fazer mexer o que já existe. Você acabou de transformar uma aposta com cinco incógnitas numa aposta com uma só.
qual modelo de imagem para esse primeiro frame
Para desbastar, o Flux Schnell a 1 crédito é imbatível. Dez testes de composição custam 10 créditos, ou seja, 0,10 €. É o rascunho descartável por excelência: rápido, nem sempre fino nos detalhes, mas suficiente para julgar um enquadramento e uma luz.
Encontrada a composição, regenere a versão final com um modelo mais caprichado: Flux Pro 1.1 ou Imagen 4 a 6 créditos, ou Flux 2 Pro a 7 créditos se você quiser o máximo de detalhe. Se o seu plano coloca em cena um personagem recorrente definido num nó Referência, o Seedream 5 Lite, a 5 créditos, é o campeão do respeito às referências.
Balanço de uma exploração séria: uns quinze créditos, rascunhos incluídos. Mais barato que um único vídeo Kling fracassado. E você chega à etapa de animação com uma certeza que o texto-para-vídeo direto nunca vai dar: você já sabe com o que o seu plano vai se parecer.
conectar a imagem no nó Vídeo
No canvas, puxe um cabo da porta de saída do nó Imagem até o nó Vídeo. O ponto de entrada acende na conexão, sinal de que o encaixe está ativo. Se você soltar o cabo em qualquer lugar sobre o nó, ele se conecta sozinho na entrada mais provável, no caso a imagem inicial.
O nó Vídeo expõe entradas diferentes conforme o modelo escolhido. A imagem inicial, sempre única, fixa o primeiro frame. Alguns modelos aceitam também uma imagem final, prática para transições controladas. E as imagens de referência mantêm seus personagens coerentes: até 9 no Seedance 2.0, mais no Seedance 2.5.
Com uma imagem inicial conectada, a composição, a luz e o rosto ficam travados. A taxa de planos utilizáveis sobe nitidamente em relação ao texto puro, porque o modelo só pode errar no movimento. Um detalhe de passagem: o Seedance em imagem-para-vídeo impõe suas próprias restrições de resolução, e a plataforma ajusta isso por você.
comece em 5 segundos e 720p, suba depois
A duração e a resolução são os dois cursores que fazem os orçamentos explodirem. Ajuste os dois no mínimo para validar, no máximo para entregar. Na prática: 5 segundos em 720p para todos os seus testes de movimento. É mais do que suficiente para julgar se o cavaleiro caminha com naturalidade ou se desliza pelo chão como um peão de xadrez.
A diferença de preço justifica a disciplina. No Seedance 2.0, o mesmo plano de 5 segundos passa de uns 48 créditos em 720p Fast para cerca de 330 créditos em 4K no modelo completo. Quase sete vezes mais caro por um teste cujo resultado você talvez jogue fora. O 4K é para a versão final, aquela que você exporta.
Mesma lógica para a duração. O Seedance 2.5 aceita clipes de até 30 segundos, o que é notável, mas um fracasso de 30 segundos custa seis vezes um fracasso de 5 segundos. Recorte suas cenas em planos curtos, valide um por um, e reserve os planos longos para os movimentos já comprovados.
qual modelo de vídeo para começar
O Imaginode dá acesso a 47 modelos, todos pagos com os mesmos créditos, o que permite trocar de fornecedor em dois cliques sem nova assinatura. Para uma primeira noite, duas apostas seguras. O Kling 2.5 Turbo, cerca de 26 créditos por 5 segundos, é o melhor custo-benefício para aprender: rápido, movimento natural, bom o bastante para julgar suas ideias. O Seedance 2.0 Fast, uns 48 créditos, entrega texturas mais finas.
Os outros nomes do catálogo vêm depois. Veo 3.1 Lite e Fast quando você quiser áudio gerado, Seedance 2.0 completo para subir a 1080p ou 4K, Seedance 2.5 para as referências múltiplas e os clipes de até 30 segundos. Grok Imagine Video, MiniMax H3, Wan 2.7, Kling V3 ou PixVerse têm cada um seus pontos fortes, mas nenhum é indispensável para um primeiro clipe.
Nosso conselho sem rodeios: fique num único modelo enquanto aprende. Cada gerador tem suas manias, seu jeito de interpretar um travelling ou uma luz, e você só progride acumulando tentativas comparáveis. Trocar de modelo a cada plano é recomeçar do zero a cada plano, e pagar o aprendizado várias vezes.
descrever o movimento, não a imagem
Sua imagem já carrega a composição, então não a repita no prompt de vídeo. Descreva apenas o que se move: o sujeito, a câmera, o ritmo. "O cavaleiro avança lentamente em direção à câmera, sua capa ondula ao vento, folhas caem em primeiro plano." Uma frase de movimento clara vale mais que um parágrafo de descrição redundante.
Formule o movimento de câmera numa frase final explícita, os modelos respondem melhor a isso do que a um adjetivo afogado no meio do texto. E seja modesto na quantidade: um sujeito que se move mais um movimento de câmera já é muita coisa para 5 segundos. Os prompts que empilham quatro ações produzem mingau.
Se o inglês técnico trava você, a varinha mágica no campo de prompt reescreve seu texto em inglês rico e estruturado via o modelo Kimi, por 1 crédito. Ela preserva suas @menções de personagens. Um crédito para dar confiabilidade a uma geração de 48, a conta se fecha sozinha.
o que ainda dá errado, honestamente
Nenhum método torna o vídeo com IA infalível, e afirmar o contrário seria mentir para você. Mesmo com uma imagem inicial limpa, conte com cerca de um fracasso a cada três ou quatro gerações. As mãos continuam sendo o ponto fraco número um: dedos fundidos, polegares a mais, objetos segurados que se deformam.
O texto na tela é o outro cemitério clássico. Um letreiro legível na sua imagem inicial tem boas chances de derreter em hieróglifos já no segundo segundo de animação. E a física continua aproximada: líquidos que desafiam a gravidade, passos de personagens que deslizam, objetos que se atravessam.
A defesa está sobretudo na escolha dos planos. Evite os closes de mãos em ação, o texto que deveria continuar legível, as interações complexas de objetos como servir um café. Prefira os rostos, as caminhadas, os climas, os movimentos de câmera sobre cenário. Um bom diretor de IA escolhe suas batalhas, exatamente como um diretor sem verba escolhe as cenas que consegue filmar.
reembolsado quando trava, pago quando fica feio
A regra merece ser cristalina porque ela estrutura o seu orçamento. Se a geração falha tecnicamente do lado do fornecedor do modelo, servidor que cai, arquivo nunca entregue, seus créditos voltam automaticamente para a sua conta em poucos segundos. Nada para pedir, nada para justificar, nenhum formulário de reclamação.
Por outro lado, um vídeo entregue mas decepcionante continua cobrado. O cavaleiro vesgo, a capa que flutua de um jeito estranho, foi entregue, então foi pago. Essa assimetria não é golpe, é o funcionamento de todos os fornecedores de modelos: o cálculo de fato aconteceu. Mas ela explica por que todo o método deste artigo mira reduzir as gerações decepcionantes em vez de torcer por reembolsos.
Faça o orçamento de acordo: para um plano final, preveja duas a três gerações de vídeo, não uma. Um plano Kling aprovado de primeira, a 26 créditos, é uma boa surpresa, não uma hipótese de trabalho. Com 2,5 gerações em média, seu plano de 5 segundos sai por cerca de 65 créditos, ou seja, 0,65 €.
três erros de iniciante que custam créditos
Primeiro erro: animar um personagem recorrente sem imagens de referência. Sem elas, o rosto muda de uma geração para outra, e você queima créditos correndo atrás de uma semelhança que o modelo não tem como conhecer. Crie um nó Referência com um nome, uma descrição e algumas fotos, e depois @mencione-o no prompt: a descrição é injetada e as fotos anexadas automaticamente.
Segundo erro: rodar em loop o mesmo prompt esperando um milagre. Se duas gerações consecutivas erram no mesmo lugar, o problema está no pedido, não no sorteio. Mude algo preciso, uma ação a menos, um movimento mais simples, antes de pagar de novo 26 créditos. O histórico do nó mostra exatamente o que já foi tentado.
Terceiro erro: disparar direto a versão definitiva em alta resolução. O reflexo do "melhor fazer certo de primeira" custa cerca de 330 créditos por tentativa em 4K no Seedance 2.0, quando a validação em 720p custa 48. Faça certo de primeira em 720p, e depois regenere uma única vez em tamanho grande.
o áudio gerado, o caso Veo
Alguns modelos não se contentam mais com a imagem. O Veo 3.1 Lite e o Fast geram também a trilha sonora: ambiente, ruídos, às vezes falas. Um plano de chuva chega com o som da chuva, um mercado com seu burburinho de multidão. O Kling V3 também oferece áudio. Para formatos curtos destinados às redes, isso economiza uma sessão de sound design.
O custo sobe, logicamente, quando o áudio está ativado, e a tarifa exata aparece como sempre no botão Gerar. Faça a pergunta antes de cada plano: se o seu clipe vai terminar montado sobre uma música, o áudio gerado vai para o lixo. Pagar mais caro por uma trilha que você vai cortar não faz o menor sentido.
Nossa opinião sem rodeios: o áudio gerado brilha nos planos de ambiente e nas cenas faladas simples, e ainda decepciona em tudo que exige sincronização precisa. Teste num plano, escute, decida. É o tipo de arbitragem que se faz de ouvido, não numa ficha técnica.
progredir com o nó Câmera
Depois de assimilar o método imagem-depois-vídeo, o nó Câmera é o seu próximo degrau. Cinco seletores ilustrados, enquadramento, objetiva em milímetros, abertura, ângulo, movimento, e o nó escreve por você os termos certos em inglês no início do prompt, ali onde os modelos dão mais peso.
O interesse para o vídeo é direto: o seletor de movimento oferece câmera fixa, travelling para frente ou para trás, panorâmica, grua subindo, órbita, câmera na mão ou zoom lento, e o inscreve numa frase final explícita do seu prompt. Chega de "cinematic camera movement" vago que não produz nada de preciso.
Um mesmo nó Câmera pode alimentar vários geradores ao mesmo tempo, o que mantém uma realização coerente entre o plano de abertura e o plano seguinte. Dedicamos um artigo inteiro a ele, "Dirigir a IA como um diretor de fotografia", com os efeitos concretos de cada ajuste. Comece simples: um plano médio, uma 35 mm, um travelling para frente lento.
um orçamento típico para uma primeira noite
Vamos colocar números numa sessão real de descoberta, a de um criador que quer três planos de 5 segundos para um teaser. Exploração das composições em Flux Schnell: umas trinta imagens, 30 créditos. Versões finais das três imagens em Flux Pro 1.1: 18 créditos. Animação em Kling 2.5 Turbo com duas tentativas por plano em média: cerca de 156 créditos. Total: mais ou menos 205 créditos, ou seja, uns 2 €.
Com o plano Starter a 13 € sem impostos e seus 900 créditos mensais, essa noite representa menos de um quarto do orçamento do mês. Um criador regular que emenda clipes vai passar ao plano Criador, 42 € sem impostos por 3.100 créditos. E para um pico pontual, as recargas começam em 1.000 créditos por 15 €.
Compare com o método ingênuo: três planos em texto-para-vídeo direto no Seedance 2.0 Fast, com a taxa habitual de fracasso, teriam consumido 400 a 500 créditos por um resultado menos controlado. O método não só custa menos, ele produz melhor. O código SIMPLE15 ainda reduz a conta em 15 % nas assinaturas.
e agora, seu primeiro plano
Vamos resumir o passo a passo para hoje à noite. Um nó Imagem, dez rascunhos Flux Schnell, uma versão final limpa. Um cabo até um nó Vídeo, Kling 2.5 Turbo ou Seedance 2.0 Fast, 5 segundos, 720p. Uma frase de movimento clara. Tudo é salvo automaticamente, e você pode até disparar a geração pelo navegador do celular, ela continua com a tela bloqueada.
Se você prefere partir de uma base já montada, os templates prontos para usar incluem cadeias imagem-para-vídeo já cabeadas: você troca os prompts, todo o resto está no lugar. E o assistente, na bolha do canto inferior direito, pode construir o workflow completo no seu lugar por 1 crédito por mensagem, vendo o seu canvas aberto.
Para ir além desse primeiro plano, a academia integrada à documentação oferece cursos em vídeo no YouTube que retomam toda a cadeia mostrando-a na tela. Próxima parada recomendada neste blog: o artigo sobre o nó Câmera, porque um plano que se move bem é, antes de tudo, um plano bem enquadrado.

Saldo