Transcribir un audio a texto
Gratis, sin registro, y sus archivos no salen de su dispositivo.
Suelte sus archivos aquí
Elegir archivosNada se sube: todo ocurre en su navegador
La primera transcripción descarga el modelo de reconocimiento de voz una sola vez, que luego su navegador conserva: unos 75 MB en precisión estándar, 240 MB en alta precisión. El vídeo, por su parte, nunca sale de su dispositivo.
Una nota de voz, un mensaje de WhatsApp, un podcast, una reunión grabada con el teléfono: suelte el archivo y el reconocimiento de voz lo convierte en texto, en párrafos que empiezan en cada silencio. La grabación permanece en su dispositivo, algo que importa para una conversación privada o una entrevista profesional.
Cómo transcribir
- 1Suelte su vídeo o grabación en el recuadro, o haga clic para elegirlo.
- 2Elija el formato: texto plano (TXT), subtítulos SRT o VTT. El idioma hablado se detecta automáticamente; también puede elegirlo en los ajustes.
- 3La primera vez, el modelo de reconocimiento de voz se descarga una sola vez. A partir de entonces, todo ocurre en su dispositivo: descargue el texto o los subtítulos.
Los formatos
MP3
El formato de audio universal. Comprime con pérdida, de forma casi inaudible a 192 kbit/s, y se reproduce en todos los dispositivos, reproductores y programas. Es el formato ideal para compartir un sonido.
M4A
El formato de audio de Apple, utilizado por las notas de voz del iPhone y por iTunes. Es AAC dentro de un contenedor MP4: buena calidad con poco peso, pero algunos reproductores y sitios web no lo aceptan.
WAV
El formato de audio sin compresión, el de los estudios y los programas de edición. Conserva la calidad íntegra, pero un minuto de sonido pesa unos diez megabytes, diez veces más que un MP3.
OGG
Un formato de audio abierto, en Vorbis o en Opus. Es el que usan los mensajes de voz de WhatsApp y de Telegram. Es ligero y de buena calidad, pero muchos reproductores, herramientas de edición y dispositivos no pueden reproducirlo.
TXT
Texto plano, legible en cualquier lugar: el contenido de la grabación, en párrafos, sin formato. Péguelo en un documento, un correo electrónico, un artículo o una herramienta de IA.
Sus archivos se quedan con usted
La conversión se hace en su navegador, con los decodificadores de su dispositivo. Ningún archivo se sube, no se guarda ninguna copia, y nadie más que usted ve sus fotos o vídeos. Puede comprobarlo en la pestaña Red de las herramientas de desarrollador de su navegador: ninguno de sus archivos sale de ahí.
Preguntas frecuentes
¿Qué archivos se aceptan?
MP3, M4A (notas de voz del iPhone), WAV, OGG y Opus (mensajes de voz de WhatsApp y Telegram), FLAC, y también vídeos MP4, MOV y WebM.
¿Se separan los distintos interlocutores?
No, el texto sigue la conversación sin indicar quién habla. Los silencios marcan los párrafos, lo que ayuda a detectar los cambios de voz.
¿El conversor es realmente gratis?
Sí, sin registro, sin marca de agua y sin límite en el número de archivos. La conversión se ejecuta en su dispositivo y no nos cuesta nada, así que no hay nada que cobrarle.
¿Se envían mis archivos a algún sitio?
No. Se leen y se convierten en su navegador, y luego se guardan directamente en su dispositivo. Ningún servidor los recibe.
¿Hay un tamaño máximo?
El límite es la memoria de su dispositivo. Las fotos y los audios se procesan sin problema; para un vídeo de varios gigabytes, un ordenador rinde mejor que un teléfono.
¿Funciona en el teléfono?
Sí, tanto en iPhone como en Android, en Safari, Chrome o Firefox. Para el vídeo hace falta un navegador actualizado: es el que proporciona los decodificadores necesarios.
Y ahora, con la IA
Voz en off IA: el mismo texto leído por tres motores
El mismo guion leído por tres motores de síntesis de voz, ElevenLabs v3, MiniMax Speech 2.8 HD y OpenAI TTS HD, para elegir tu voz en off de oído. El flujo completo, sin crear cuenta.
Abrir la herramienta