O canvas e os nodes
Texto, imagem, vídeo, media, referência, estilo: como ligar os nodes em workflows.
Os tipos de nodes
Texto contém uma ideia ou prompt, e até pode escrevê-lo por si com um modelo de linguagem (GPT-5, Claude, Gemini…). Imagem e Vídeo geram conteúdo com IA. Media importa os seus ficheiros. Câmara define o olhar sobre a cena. Referência memoriza uma personagem ou objeto recorrente. Estilo impõe uma direção artística.
Cada node move-se livremente; elimine-o com a cruz ou a tecla Delete. Anule e refaça com Ctrl+Z / Ctrl+Y.
Ligar os nodes
Puxe uma ligação da pega direita de um node para a pega esquerda de outro. Um node Texto ligado à porta «prompt» de uma Imagem acrescenta o seu texto ao prompt: um destaque azul no node confirma o que é tido em conta. Uma Imagem ligada a um Vídeo torna-se o seu primeiro frame. Um Media de imagem serve de referência visual.
Alguns modelos de vídeo aceitam também uma imagem final: a porta «imagem final» aparece automaticamente quando o modelo o permite.
@Referências e estilos
Crie um node Referência com nome, descrição e fotos: a sua personagem. Depois escreva @ em qualquer prompt: a lista das suas referências aparece, e a menção escolhida surge em verde néon. Na geração, a descrição é injetada no prompt e as imagens são anexadas (com um modelo compatível com edição como o Seedream 5 Lite ou o GPT Image Mini).
O node Estilo funciona da mesma forma, mas por ligação: ligue-o aos seus nodes Imagem e Vídeo para manter a mesma direção artística em todo o lado.
Combinar
Exemplo de workflow completo: Texto → Imagem (Flux 2 Klein) → Vídeo (Kling), com um node Câmara ligado a ambos para um resultado coerente e um Estilo partilhado. Cada node Imagem e Vídeo guarda o histórico das suas gerações: clique numa miniatura para voltar. Tudo é guardado automaticamente.
O nó Retoque
O nó Retoque é uma pequena oficina de camadas no canvas. Ligue nós Imagem ou Mídia à sua porta Camadas: cada imagem vira uma camada que você move, redimensiona, gira, atenua e mescla com as outras. A borracha torna uma área transparente (para recortar um sujeito ou abrir uma janela para a camada de baixo), o pincel Restaurar a traz de volta. Adicione um texto por cima, escolha o tamanho do documento e o fundo, e exporte: o PNG mantém a transparência, tudo é calculado no seu navegador, sem créditos.
Cada camada de imagem tem duas ações de IA: retocar uma área (você destaca, descreve, o Nano Banana substitui) e ampliar (Topaz, ×2 ou ×4), pelo mesmo preço dos outros nós. Um clique volta à imagem anterior. A saída do nó liga-se onde qualquer imagem se liga: quadro inicial de um vídeo, referência, montagem.
As ferramentas de vídeo: movimento, prolongamento, lábios, fundo
O node Vídeo não se limita a gerar: dependendo do modelo escolhido, ele transforma um vídeo existente. O Kling 3.0 Motion Control retoma o gesto de um vídeo (porta "Vídeo de movimento") e faz o personagem de uma imagem (porta de imagem) reproduzi-lo: uma dança, um jeito de andar, uma coreografia, em qualquer rosto. O Grok Imagine (prolongar) gera a continuação de um vídeo a partir do seu último quadro, no mesmo formato: você define quantos segundos adicionar e descreve o que acontece a seguir. A continuação sai isolada, para ser encadeada no node Montagem.
O Sync Lipsync 3 realinha os lábios de um vídeo com uma voz conectada (porta de voz): outro idioma, outro texto, no mesmo plano. O InfiniTalk faz o mesmo a partir de uma foto: o rosto fala durante toda a duração da voz, incluindo as expressões. O Bria fundo de vídeo remove o cenário de um vídeo e mantém o sujeito e seu som: saída webm transparente para suas montagens, ou mp4 sobre fundo verde, preto ou branco.
Essas cinco ferramentas são cobradas com base na fonte medida no servidor, nunca em uma duração declarada: o node lê a duração do vídeo ou da voz conectada e mostra o preço exato antes de você clicar. Um modelo só exibe os ajustes que realmente respeita: quando um seletor não aparece, é porque o modelo não o considera.
Ler um PDF em um node Texto
Arraste um PDF para o canvas: um node Mídia o recebe, assim como uma imagem ou um vídeo. Conecte-o à porta "Imagem ou PDF a analisar" de um node Texto configurado com um modelo que lê documentos (GPT, Claude, Gemini, Kimi K3, Grok 4.6, DeepSeek V4 e outros marcados como tais): o modelo recebe o documento inteiro e responde à sua instrução, resumo, extração, reescrita, plano de conteúdo, prompts de ilustração.
O preço acompanha o tamanho do documento: o node reserva o custo no momento do envio do arquivo, depois se ajusta ao número de tokens efetivamente lidos, e a diferença volta para o seu saldo. Até três documentos por node. A resposta alimenta diretamente os nodes Imagem e Vídeo conectados a seguir: um relatório se transforma em carrossel, um manual se transforma em tutorial em vídeo.
Meus personagens
Um node Referência bem preenchido (nome, descrição, fotos) vale a pena ser guardado. O botão "Salvar em Meus personagens" o armazena na sua conta. Em qualquer outro projeto, "Meus personagens" abre a lista e preenche um node Referência com um clique, nome, descrição e imagens incluídos. Até trinta personagens por conta, oito imagens cada.
Um personagem editado se atualiza a partir do node que o carregou, e se exclui a partir da lista. É isso que permite manter a mesma mascote, o mesmo apresentador ou o mesmo produto de uma semana para outra, sem refazer a ficha.
O node Objeto 3D
O node Objeto 3D transforma uma imagem em um arquivo 3D. Conecte uma imagem (foto importada ou renderização de um node Imagem): o Tripo 2.5 ou o Trellis 2 geram um GLB texturizado, o formato lido pelo Blender, Unity, Unreal e visualizadores web. O modelo é exibido no node, gira ao toque do dedo ou do mouse, e pode ser baixado.
Duas renderizações são feitas em seguida no seu navegador, sem custo: uma volta de câmera de cinco segundos (porta de vídeo) e uma vista fixa (porta de imagem). A volta de câmera se conecta como referência a um node Vídeo, Wan 3.0 ou Seedance 2.5, que preserva a forma do objeto ao colocá-lo em cena. A vista se conecta em qualquer lugar que aceite uma imagem. Um objeto inteiro, sobre um fundo simples, gera o melhor volume; uma cena ou um sujeito cortado pelo enquadramento gera um resultado inferior.