Sonorizar um vídeo mudo
Os vídeos gerados saem muitas vezes sem som. Uma camada descrita a partir do plano, um loop, e o nó Montagem põe-na debaixo da imagem: o fluxo sonorizar um vídeo faz exatamente isso.
Três efeitos sonoros criados pelo ElevenLabs Sound Effects a partir de um texto: chuva num telhado de chapa em loop, uma porta de castelo a ranger, um estádio a explodir. O fluxo completo, visível sem conta.
Workflow real, resultados reais. Desloque-se e faça zoom livremente.
Usar este workflowFluxo real: três nós Texto ligados a três nós Som no ElevenLabs Sound Effects, com três afinações diferentes. Ouve os três.
Em resumo
O som que te falta nunca está na biblioteca: a porta range, mas não assim; a chuva cai, mas num telhado de telha. O ElevenLabs Sound Effects fabrica o som que descreves, em poucos segundos e por alguns cêntimos. Este fluxo produz três, um por família: uma camada em loop, um som pontual, uma multidão.
Um efeito sonoro descreve-se pelo que se ouve, nunca pelo que se vê. «Um telhado à chuva» é uma imagem; «chuva forte a tamborilar em chapa ondulada, água a pingar numa poça» é um som. As três instruções da demo estão escritas assim, e todas terminam com «sem música, sem vozes»: sem essa proibição, o modelo acrescenta-as de bom grado.
Os três nós não têm as mesmas afinações, e essa é a lição. A chuva pede dez segundos e o loop, para rodar sem emenda debaixo de um plano mais longo. A porta pede cinco segundos e uma fidelidade ao texto mais alta. A multidão pede uma fidelidade mais baixa, que deixa o modelo improvisar. Os três sons custam dez cêntimos no total.
Descreve o que se ouve
Matéria, ação, distância, ambiente: «pesada porta de madeira a ranger em dobradiças enferrujadas, depois baque surdo contra a pedra». Bane os adjetivos visuais, não se ouvem.
Afina a duração
Um som pontual, três a cinco segundos. Uma camada, dez a vinte e dois segundos, o teto do modelo. Demasiado longo para um som curto, e o modelo repete-o ou afoga-o.
Liga o loop para uma camada
Chuva, vento, uma multidão a murmurar, um motor: o loop pede ao modelo um início e um fim que se juntem. A montagem repete-o depois sem emenda.
Doseia a fidelidade ao texto
Alta (0,7) para um som preciso que descreves de perto. Baixa (0,4 a 0,5) para um ambiente onde o modelo pode inventar os detalhes. A demo mostra as duas.
O mesmo canvas, afinado para necessidades diferentes: cada variante são duas ou três linhas de prompt a mudar.
Os vídeos gerados saem muitas vezes sem som. Uma camada descrita a partir do plano, um loop, e o nó Montagem põe-na debaixo da imagem: o fluxo sonorizar um vídeo faz exatamente isso.
Um clique, uma notificação, uma moeda apanhada, uma porta a abrir: sons curtos, fidelidade alta, dois segundos cada. Três nós para três variantes, fica a melhor.
Chuva atrás de uma cena, um café a murmurar, uma floresta à noite. Vinte e dois segundos em loop, a baixo volume debaixo da voz. A instrução diz a distância: «ao longe», «atrás de um vidro».
Um dragão, uma explosão, uma avalanche, uma nave. Descreve-os com sons reais que o modelo conhece: rugido, sopro, ronco, estalidos de gelo, turbina.
O trovão na deixa certa, o sino, o comboio a passar. Cada som no seu nó, exportado em MP3, pronto para a régie. Tudo custa menos do que um café.
Se o resultado tiver sopro ou um artefacto, o nó Melhorar em modo limpeza retira-o. Raramente é preciso, mas é útil para um som que vai rodar em loop muito tempo.
«Uma floresta no outono» não se ouve. «Folhas secas a estalar sob os passos, vento leve nos ramos, um corvo ao longe» ouve-se. O modelo não vê nada, escuta a tua frase.
O modelo tende a vestir um ambiente com uma camada musical ou um murmúrio de vozes. Uma frase no fim da instrução chega para o impedir.
Uma porta a ranger durante quinze segundos são quinze segundos de rangido. Três a cinco segundos para um som pontual, a duração afina-se no nó.
Sem o loop ligado, a camada tem um início e um fim que se ouvem quando a montagem a repete. Liga-o para todo o som que deva rodar mais do que a sua duração.
Entre um e vinte e dois segundos, afinado no nó. Para um ambiente mais longo, liga o loop e deixa a montagem repetir o som.
Fá-lo assim que não lho proíbem, sobretudo nos ambientes. Daí «sem música, sem vozes» no fim de cada instrução da demo.
Sim, é até aí que é melhor: uma nave a descolar, uma criatura a respirar, uma porta mágica. Descreve-o com sons reais: «assobio de turbina, ronco grave, estalidos metálicos».
Dois ou três créditos consoante a duração, alguns cêntimos. Os três sons da demo somam oito créditos. O preço aparece no nó antes de clicares.
Em MP3, descarregável a partir do nó ou ligado diretamente ao nó Montagem. O ficheiro tem algumas centenas de kilobytes.
São gerados para ti e não existem em mais lado nenhum. As condições da ElevenLabs permitem o uso comercial numa conta paga, que é a que corre aqui.
Diz ao modelo até que ponto seguir a tua frase à letra. Alta, produz exatamente o que está descrito, por vezes um pouco rígido. Baixa, improvisa detalhes à volta, mais vivo mas menos previsível.
Sim. A tela funciona no telemóvel, a instrução escreve-se no nó Texto e o som ouve-se no nó Som. O guia criar no telemóvel explica os gestos.
Gerador de efeitos sonoros com IA
Usar este workflowConta gratuita, sem cartão. O workflow abre-se pré-preenchido no seu canvas.