Todas as ferramentas

Limpar uma gravação com IA

Uma nota de voz ditada numa esplanada barulhenta, passada pelos dois redutores de ruído do catálogo lado a lado, DeepFilterNet 3 e ElevenLabs Audio Isolation. O fluxo completo, sem criar conta.

Demo interativa

Workflow real, resultados reais. Desloque-se e faça zoom livremente.

Usar este workflow

O fluxo real: a mesma nota com ruído entra em dois nodes Melhorar um som, e ouve o que cada um tirou.

Em resumo

O que o workflow produz
2 ficheiros áudio processados
Estrutura do canvas
3 nodes ligados por 0 ligações
Modelos ligados
DeepFilterNet 3, ElevenLabs Audio Isolation
Custo de uma passagem completa
cerca de 6 créditos, ou seja US$ 0,07

Uma entrevista gravada com o telemóvel num café, uma nota de voz ditada na rua, uma voz de podcast com o frigorífico atrás: o ruído de fundo é o que separa uma gravação utilizável de uma para repetir. Este fluxo tira-o com os dois modelos do catálogo que o sabem fazer, e põe-nos lado a lado porque não trabalham da mesma forma.

O DeepFilterNet 3 é um filtro: tira o que não é voz e deixa o ar da sala, o resultado continua natural. O ElevenLabs Audio Isolation reconstrói a voz: mais seca, mais de rádio, por vezes um pouco sintética nas consoantes. Na nota da demo, fabricada de propósito misturando uma voz limpa com um ambiente de rua e um zumbido, sabemos exatamente o que havia para tirar.

O seu ficheiro entra pelo botão de importar do node, até dez minutos por passagem, e o preço conta-se ao segundo: as duas limpezas sobre catorze segundos custam sete cêntimos, e o DeepFilterNet sozinho fica em nove créditos por minuto.

Como fazer

  1. 1

    Importe a gravação

    MP3, WAV, M4A ou OGG, até dez minutos. O node lê a duração e mostra o preço antes de qualquer clique. Um áudio produzido noutro sítio da tela também se liga à porta.

  2. 2

    Lance o filtro

    DeepFilterNet 3 primeiro: é o mais barato e o mais fiel. Se a voz sai clara e a sala ainda lá está, terminou.

  3. 3

    Experimente a reconstrução

    Se o ruído era forte, ou se a voz tem de assentar em música, lance o isolamento ao lado. Sai mais seca, o que se mistura melhor numa montagem.

  4. 4

    Ouça as consoantes

    É aí que os dois se separam: os «s» e os «t» são o que um redutor de ruído estraga primeiro. O ficheiro vencedor vai para a montagem ou transfere-se a partir do node.

Variantes e casos de uso

O mesmo canvas, afinado para necessidades diferentes: cada variante são duas ou três linhas de prompt a mudar.

Uma entrevista ao telemóvel

O caso de escola: duas pessoas num café, o telemóvel pousado entre elas. O filtro tira as chávenas e a máquina de café, as duas vozes ficam, com a distância que vem com elas. Uma passagem costuma chegar.

Uma voz de podcast gravada em casa

O frigorífico, a rua pela janela, a ventoinha do computador: um ruído constante e suave que o filtro tira sem deixar rasto. Numa voz perto do microfone, o DeepFilterNet é o que é preciso, a reconstrução seria demais.

Uma nota ditada na rua

A nota da demo. Ruído forte e variável, carros e transeuntes. O filtro deixa um fundo, a reconstrução apaga-o: aqui ganha ela, porque queremos perceber, não guardar o ambiente.

Uma voz que vai para um vídeo

Uma voz off gravada sem estúdio, para pôr sobre imagens e música. O resultado do isolamento, mais seco, mistura-se melhor na Montagem do que uma voz que ainda arrasta a sala atrás.

Uma gravação antiga de família

Uma cassete digitalizada, com o seu sopro e o seu zumbido. O filtro tira o sopro e guarda a voz tal como era, que é o que se quer de uma recordação: nítida, não reescrita.

Uma palestra captada da sala

Uma voz distante, reverberação, tosses. Os dois limpam o ruído; nenhum encurta a reverberação da sala, que não é ruído mas espaço. Espere uma voz clara mas ainda distante.

Erros frequentes

Limpar antes de cortar

O preço conta-se ao segundo. Limpar uma hora de gravação para guardar dez minutos custa seis vezes demais. Corte primeiro, limpe depois, sobre a passagem que guarda.

Empilhar os dois tratamentos

O filtro e depois a reconstrução, ou o inverso, não dá uma limpeza duas vezes melhor: o segundo modelo trabalha sobre uma voz já transformada e acentua os seus artefactos. Uma só passagem, escolhida de ouvido.

Esperar um estúdio de uma gravação distante

Um redutor de ruído tira o que não é a voz; não aproxima um microfone que estava a três metros. A reverberação e a distância ficam. O que vai ouvir é a mesma voz, sem o ruído à volta.

Limpar uma música por engano

Uma gravação de concerto passada por um redutor de ruído sai com a voz e sem a banda: os instrumentos são tratados como ruído. Para uma música, é a separação em faixas que é precisa, não a limpeza.

Modelos recomendados

Perguntas frequentes

Qual dos dois escolher?

O filtro primeiro, quase sempre: tira o ruído sem reescrever a voz. A reconstrução quando o ruído era mais forte do que a voz, ou quando o resultado tem de se fundir com uma música, porque um timbre mais seco mistura-se melhor.

Funciona com música?

Não, e é de propósito. Os dois modelos guardam a voz e deitam fora o resto: numa música, a música é tratada como ruído. Para separar uma música em faixas, o fluxo separar a voz de uma música faz esse trabalho com o Demucs.

E se falarem duas pessoas?

As duas vozes são guardadas, nenhum dos modelos distingue os falantes. O que sai é o ruído entre elas, não uma delas. Para guardar só uma voz, descreve-se o que se procura ao SAM Audio, outro node do catálogo.

Quanto custa uma limpeza?

O DeepFilterNet 3 fica em nove créditos por minuto, o isolamento ElevenLabs em catorze. A nota da demo, catorze segundos nos dois nodes, custa seis créditos. O preço aparece no node antes do clique, sobre a duração medida do seu ficheiro.

Qual é a duração máxima?

Dez minutos por passagem. Uma gravação mais longa corta-se em pedaços na montagem, ou limpa-se só nas passagens que guarda, o que de qualquer forma é mais barato.

A limpeza muda a voz?

O filtro, não: tira, não acrescenta nada. A reconstrução, um pouco: reescreve a voz a partir do que reconheceu, e nas consoantes sibilantes pode ouvir-se. É por isso que a demo mostra os dois.

Posso limpar o áudio de um vídeo?

Sim, em dois tempos: a Montagem exporta a faixa de som, o node limpa-a, e a voz limpa volta a assentar nas imagens no lugar da antiga.

As minhas gravações servem para treinar modelos?

Não. O que importa fica no seu espaço e não é entregue a nenhum treino, e a pergunta pesa mais aqui do que noutro lado: fala-se muitas vezes de entrevistas e de vozes de pessoas próximas.

Limpar uma gravação com IA

Usar este workflow

Conta gratuita, sem cartão. O workflow abre-se pré-preenchido no seu canvas.