Transcrever um áudio em texto

Gratuito, sem cadastro, e seus arquivos não saem do seu dispositivo.

Solte seus arquivos aqui

Escolher arquivos

Nada é enviado: tudo acontece no seu navegador

A primeira transcrição baixa o modelo de reconhecimento de voz uma única vez, que seu navegador mantém em seguida: cerca de 75 MB na precisão padrão, 240 MB na alta precisão. O vídeo, por sua vez, nunca sai do seu dispositivo.

Um memorando de voz, uma mensagem do WhatsApp, um podcast, uma reunião gravada no celular: solte o arquivo, e o reconhecimento de voz o transforma em texto, com um novo parágrafo a cada silêncio. A gravação permanece no seu dispositivo, o que faz diferença em uma conversa privada ou uma entrevista profissional.

Como transcrever

  1. 1Solte seu vídeo ou gravação na caixa, ou clique para escolhê-lo.
  2. 2Escolha o formato: texto corrido (TXT), legendas SRT ou VTT. O idioma falado é detectado automaticamente; você também pode escolhê-lo nas configurações.
  3. 3Na primeira vez, o modelo de reconhecimento de voz é baixado uma única vez. Depois disso, tudo acontece no seu dispositivo: baixe o texto ou as legendas.

Os formatos

MP3

O formato de áudio universal. Comprime com perda, de forma quase imperceptível a 192 kbit/s, e é reproduzido em qualquer dispositivo, player ou programa. É o formato ideal para compartilhar um áudio.

M4A

O formato de áudio da Apple, usado pelo Memos de Voz do iPhone e pelo iTunes. É um AAC dentro de um contêiner MP4: boa qualidade para um tamanho pequeno, mas alguns players e sites não o aceitam.

WAV

O formato de áudio não comprimido dos estúdios e programas de edição. Preserva a qualidade total, mas um minuto de áudio pesa cerca de dez megabytes, dez vezes mais que um MP3.

OGG

Um formato de áudio aberto, em Vorbis ou Opus. É o formato das mensagens de voz do WhatsApp e do Telegram. É leve e tem boa qualidade, mas muitos players, ferramentas de edição e dispositivos não conseguem reproduzi-lo.

TXT

Texto simples, legível em qualquer lugar: o conteúdo da gravação, em parágrafos, sem formatação. Cole em um documento, um e-mail, um artigo ou uma ferramenta de IA.

Seus arquivos ficam com você

A conversão acontece no seu navegador, com os decodificadores do seu dispositivo. Nenhum arquivo é enviado, nenhuma cópia é guardada, e ninguém além de você vê suas fotos ou seus vídeos. Você pode verificar isso na aba Rede das ferramentas de desenvolvedor do seu navegador: nenhum dos seus arquivos sai dali.

Perguntas frequentes

Quais arquivos são aceitos?

MP3, M4A (memorandos de voz do iPhone), WAV, OGG e Opus (mensagens de voz do WhatsApp e do Telegram), FLAC, e também vídeos MP4, MOV e WebM.

Os diferentes interlocutores são separados?

Não, o texto segue a conversa sem indicar quem fala. Os silêncios marcam os parágrafos, o que ajuda a perceber as mudanças de voz.

O conversor é realmente gratuito?

Sim, sem cadastro, sem marca d'água e sem limite de quantidade de arquivos. A conversão acontece no seu dispositivo e não nos custa nada, então não há motivo para cobrar nada de você.

Meus arquivos são enviados para algum lugar?

Não. Eles são lidos e convertidos no seu navegador, e depois salvos diretamente no seu dispositivo. Nenhum servidor os recebe.

Existe um tamanho máximo?

O limite é a memória do seu dispositivo. Fotos e áudios passam sem problema; para um vídeo de vários gigabytes, um computador se sai melhor do que um celular.

Funciona no celular?

Sim, tanto no iPhone quanto no Android, no Safari, Chrome ou Firefox. Para vídeo, é necessário um navegador atualizado: ele fornece os decodificadores usados.

E agora, com IA

Voz off IA: o mesmo texto lido por três motores

O mesmo guião lido por três motores de síntese de voz, ElevenLabs v3, MiniMax Speech 2.8 HD e OpenAI TTS HD, para escolher a sua voz off de ouvido. O fluxo completo, sem criar conta.

Abrir a ferramenta

Outras conversões

Todas as conversões