15 de setembro de 2026
Previz 3D para vídeo com IA: bloquear sua cena antes de gerar, o método completo
Por que os cineastas de IA estão passando de dez prompts fracassados para uma cena 3D ajustada de uma vez, o que uma previz precisa produzir para pilotar Seedance, Kling ou Wan, e como fazer isso no navegador, sem software 3D, por poucos centavos.

Frank HoubreFundador do Imaginode
O problema que todo mundo conhece: o gerador não vê o seu plano
Um gerador de vídeo entende um movimento de câmera quando você o mostra, não quando você o escreve. A previz 3D fabrica o que é preciso mostrar.
Você tem o plano na cabeça. Um travelling baixo que segue um personagem por um corredor, a câmera que se eleva no momento em que ele empurra a porta, a luz que entra. Você escreve tudo isso no prompt, gera, e o modelo entrega uma câmera plantada no meio, um personagem andando em direção à lente e uma porta que não existe mais. Segunda tentativa, terceira, décima. Cada tentativa custa entre 20 e 60 créditos, e você ainda não tem certeza de que a décima primeira vai dar certo.
Não é um problema de vocabulário. Modelos de vídeo como Seedance 2.5, Kling V3 ou Wan 3.0 leem muito bem "travelling", "contra-plongée" ou "35 mm". O problema é que essas palavras descrevem um número infinito de planos possíveis, e o modelo escolhe um ao acaso. O que elimina a ambiguidade é uma imagem inicial, uma imagem final e, quando o modelo aceita, um vídeo de referência do movimento.
É exatamente isso que uma previz produz: a versão cinza e simplificada do seu plano, com volumes reais, personagens em manequim reais e uma câmera real, que você ajusta uma vez e que serve de referência para todas as gerações seguintes. O cinema faz isso há trinta anos antes de filmar. O vídeo com IA acaba de descobrir que precisa disso ainda mais.
O que é uma previz, e o que ela não é
A previz não é um render 3D finalizado: é um blocking, volumes simples colocados no lugar certo, filmados por uma câmera com os valores certos.
Na produção tradicional, a previsualização (previz para todo mundo) é a etapa em que se constrói o plano em 3D antes de filmar. Sem texturas, sem atores, sem cenários detalhados: caixas para as paredes, cilindros para as colunas, manequins para os atores. O que importa está em outro lugar: onde está a câmera, qual lente, a que altura, qual movimento, a que velocidade, e quem está onde no quadro a cada segundo.
Tudo o que é cinza em uma previz é cinza de propósito. No dia em que você coloca texturas, começa a discutir a textura em vez de discutir o enquadramento. A previz existe para resolver questões de encenação, e ela as resolve melhor quando ainda não se parece com o filme.
Para o vídeo com IA, a previz tem uma função extra: ela gera arquivos que o gerador sabe ler. Uma imagem nítida do primeiro quadro, uma imagem nítida do último, um vídeo de alguns segundos onde se vê exatamente o movimento, e uma descrição do plano escrita nos termos que os modelos entendem. Ela não é mais uma ferramenta de discussão, é metade do prompt.
As quatro coisas que uma previz precisa fornecer
Imagem inicial, imagem final, vídeo de referência, prompt estruturado: com esses quatro arquivos, a geração se torna execução, e não uma loteria.
A imagem inicial fixa o enquadramento do primeiro segundo. Todos os modelos de imagem para vídeo a aceitam: é a garantia de que o plano começa exatamente onde você decidiu, com o personagem certo no lugar certo. A imagem final, aceita por Seedance, Kling e Wan, fixa o último segundo. Entre as duas, o modelo só precisa interpolar um movimento coerente, o que ele faz bem.
O vídeo de referência é o render cinza da previz, como ele é. Alguns modelos o aceitam como referência de movimento: o Kling 3.0 Motion Control reproduz o gesto e a trajetória de um vídeo no personagem de uma imagem. Nesse caso, a câmera que você desenhou se torna literalmente a câmera do render. Para os outros modelos, ele serve como referência visual e verificação: compara-se o render com a previz, plano por plano.
O prompt estruturado, por fim, descreve o plano em termos de cinema: duração, proporção, posição inicial da câmera em relação ao sujeito, altura, lente e sua sensação (grande angular, retrato), movimento (travelling de tantos metros a tal velocidade, subida de tanto, panorâmica de tantos graus), o que os personagens fazem, a atmosfera e as luzes. Escrito à mão, esse parágrafo leva vinte minutos e contém erros. Gerado a partir da cena, ele é exato, porque é calculado.
Tudo isso fica em uma pasta zip que o studio 3D Previz do Imaginode exporta com um clique, com os metadados de câmera em JSON para quem quiser ir mais longe. O guia do studio detalha cada arquivo.
Fazendo sua previz no navegador, sem software 3D
Uma frase basta para obter uma cena, o mouse faz o resto, e a renderização é gratuita: a previz deixa de ser reservada a quem sabe animar no Blender.
Até agora, fazer uma previz significava abrir o Blender, o Unreal ou o Cinema 4D, modelar volumes, montar uma câmera e aprender a animar quadros-chave. Semanas de curva de aprendizado para alguém que só quer decidir um enquadramento. O 3D Previz do Imaginode inverte o problema: você descreve a cena em uma frase, com imagens de referência se tiver, e um diretor de IA a constrói em 3D no seu navegador.
Na prática, "um corredor de hospital à noite, um enfermeiro caminhando em direção a uma porta no fundo, câmera baixa atrás dele" gera um corredor, portas, um manequim nomeado, uma luz fria, uma câmera de 35 mm posicionada a 80 cm do chão atrás do personagem. Não é uma imagem gerada: é uma cena editável, onde cada elemento pode ser selecionado, movido e ajustado. A construção custa a partir de 5 créditos, geralmente 12 (um crédito equivale a um centavo), e o preço é exibido antes de clicar, como em todo o Imaginode.
Depois, você ajusta. Seleciona a câmera, escolhe a lente de 14 a 135 mm, aplica um dos 25 movimentos (travelling para frente, guindaste, órbita, revelação, vertigo, câmera na mão) ou desenha o percurso clique após clique no chão. Você grava uma câmera virtual manualmente, em modo voo, e depois a suaviza. Você posiciona a imagem inicial e a imagem final. Você pede ao diretor de IA "recue a câmera dois metros e mude para 50 mm" quando prefere falar em vez de clicar.
E exporta: imagem, vídeo mp4 codificado diretamente no navegador, prancha de contato, storyboard de todos os planos, pacote de IA. Nenhum crédito consumido em nada disso. A previz do pássaro e do balão que ilustra a página do studio foi renderizada assim: 27 segundos de perseguição em uma única tomada, exportados em 1080p em poucos segundos.
Do blocking ao render: o percurso no canvas
A previz vive no mesmo projeto que a geração: as imagens exportadas se tornam as entradas de um node Vídeo, sem passar pelo disco.
O percurso completo tem quatro etapas. Um, descrever a cena e deixar o diretor de IA fazer o blocking. Dois, ajustar o plano ou os planos: câmera, lente, movimento, posição dos personagens na linha do tempo. Três, exportar o pacote de IA do plano. Quatro, no canvas do Imaginode, conectar a imagem inicial e a imagem final a um node Vídeo, colar o prompt estruturado, escolher o modelo e gerar.
Para a escolha do modelo, a regra é simples. Um plano em que a câmera se move muito e o personagem faz um gesto preciso vai para o Kling 3.0 Motion Control com o vídeo de referência. Um plano em que o enquadramento importa mais do que o gesto vai para o Seedance 2.5 com imagem inicial e imagem final, ou para o Wan 3.0 para planos longos de até 30 segundos. Nosso guia direcionar a câmera de um gerador de vídeo com IA compara os comportamentos modelo por modelo.
Um detalhe que muda tudo: a previz não precisa ser refeita. Se o primeiro render não estiver bom, você troca de modelo ou ajusta o prompt, mas a cena, a câmera e as imagens permanecem. Você não parte mais do zero em cada tentativa, e é ali que os créditos são economizados.
Quanto custa, comparado com o método dos "dez prompts"
Uma previz custa uma dúzia de créditos uma vez; cada geração de vídeo evitada economiza de vinte a sessenta.
Tomemos um plano de 10 segundos em 1080p. No canvas, uma geração no Seedance 2.5 fica em torno de 60 créditos, o Kling V3 um pouco abaixo, o Wan 3.0 acima disso dependendo da resolução; a calculadora dá os valores exatos do dia. Dez tentativas para chegar ao enquadramento desejado são de 400 a 600 créditos, ou seja, 4 a 6 euros, para um único plano.
Com uma previz, a cena custa uma dúzia de créditos, os ajustes por mensagem custam dois ou três, a renderização e as exportações nada. Depois se gera uma ou duas vezes em vez de dez. Em um filme de vinte planos, a diferença se conta em dezenas de euros e horas de espera evitadas. E o argumento que mais importa não é o preço: é que o enquadramento final é aquele que você tinha decidido.
A Higgsfield lançou em 4 de setembro de 2026 uma ferramenta de cena 3D por prompt, o 3D Jutsu, por assinatura. Analisamos de perto em este artigo: as duas abordagens se parecem no princípio, mas diferem no preço, na integração com o gerador e no controle de câmera.
Cinco erros de previz que custam caro depois
Uma previz útil é simples, em escala, e pensada para o modelo que vai lê-la.
Primeiro erro: querer que a previz seja bonita. Ela precisa ser legível. Volumes cinzas e um manequim são suficientes; uma cena carregada de detalhes torna o movimento de câmera menos visível no vídeo de referência, e o modelo se prende a detalhes que não fazem sentido.
Segundo: esquecer a escala. Um manequim mede 1,75 m, uma porta 2,10 m, um carro 4,5 m. Se as proporções estiverem erradas, a lente mente, e o render terá aparência de maquete. O kit de blocking do Imaginode posiciona cada objeto no seu tamanho real, e o posicionamento inteligente o coloca no chão.
Terceiro: uma câmera que faz tudo ao mesmo tempo. Um travelling, uma subida, uma panorâmica e um zoom no mesmo plano de 8 segundos, nenhum modelo acompanha. Um movimento principal por plano, dois no máximo. Os 25 presets do studio existem para isso.
Quarto: negligenciar a imagem final. É ela que impede o modelo de derivar na segunda metade do plano, e é a primeira coisa que as pessoas esquecem de exportar. Quinto: não nomear os personagens. Um manequim chamado "Léa" na cena se torna "Léa" no prompt estruturado, e você pode conectar a ele seu personagem de referência no canvas.
Por onde começar
Um plano, uma frase, uma exportação: em dez minutos você saberá se o método é para você.
Escolha um plano que você nunca conseguiu obter por prompt. Abra o 3D Previz, descreva-o em uma frase, deixe a cena se construir. Ajuste a câmera com o mouse até que a visualização mostre o quadro que você tinha em mente, posicione a imagem inicial e a imagem final, exporte o pacote.
Depois gere uma única vez no canvas, com o modelo adequado. Compare com o render cinza. Se o plano estiver lá, você acaba de economizar nove gerações. Se não, você sabe exatamente o que desviou, porque tem uma referência ao lado. É isso, a previz: uma referência contra a qual julgar, em vez de uma lembrança do que você queria.