Transkripsikan audio menjadi teks
Gratis, tanpa pendaftaran, dan file Anda tidak pernah meninggalkan perangkat Anda.
Masukkan file Anda di sini
Pilih fileTidak ada yang diunggah: semuanya terjadi di browser Anda
Transkripsi pertama mengunduh model pengenalan suara satu kali, lalu disimpan oleh browser Anda: sekitar 75 MB untuk akurasi standar, 240 MB untuk akurasi tinggi. Videonya sendiri tidak pernah keluar dari perangkat Anda.
Memo suara, pesan WhatsApp, podcast, rapat yang direkam lewat ponsel: letakkan filenya, lalu pengenalan suara akan mengubahnya menjadi teks, dengan paragraf baru di setiap jeda. Rekamannya tetap berada di perangkat Anda, yang penting untuk percakapan pribadi atau wawancara profesional.
Cara mentranskripsikan
- 1Letakkan video atau rekaman Anda di kotak ini, atau klik untuk memilihnya.
- 2Pilih formatnya: teks biasa (TXT), subtitel SRT atau VTT. Bahasa yang diucapkan terdeteksi secara otomatis; Anda juga bisa memilihnya di pengaturan.
- 3Pertama kali digunakan, model pengenalan suara diunduh sekali untuk selamanya. Setelah itu, semuanya berlangsung di perangkat Anda: unduh teks atau subtitelnya.
Tentang format ini
MP3
Format audio universal. Kompresinya bersifat lossy, hampir tidak terasa pada bitrate 192 kbps, dan bisa diputar di semua perangkat, pemutar, dan aplikasi. Format ini paling tepat dipilih untuk membagikan audio.
M4A
Format audio milik Apple, dipakai oleh Memo Suara di iPhone dan iTunes. Formatnya adalah AAC dalam kontainer MP4: kualitas bagus dengan ukuran kecil, tetapi beberapa pemutar dan situs tidak mendukungnya.
WAV
Format audio tanpa kompresi, biasa dipakai di studio dan aplikasi edit audio. Kualitasnya tetap utuh, tetapi satu menit audio berukuran sekitar sepuluh megabita, sepuluh kali lebih besar daripada MP3.
OGG
Format audio terbuka, menggunakan Vorbis atau Opus. Ini adalah format pesan suara di WhatsApp dan Telegram. Ukurannya ringan dan kualitasnya bagus, tetapi banyak pemutar, alat edit, dan perangkat tidak bisa memutarnya.
TXT
Teks biasa, terbaca di mana saja: isi rekaman, dalam bentuk paragraf, tanpa pemformatan. Tinggal tempelkan ke dokumen, e-mail, artikel, atau alat AI.
File Anda tetap di perangkat Anda
Konversi dilakukan di browser Anda, menggunakan decoder perangkat Anda sendiri. Tidak ada file yang diunggah, tidak ada salinan yang disimpan, dan tidak ada orang lain selain Anda yang melihat foto atau video Anda. Anda bisa memeriksanya di tab Network pada alat pengembang browser Anda: tidak satu pun file Anda yang terkirim keluar.
Pertanyaan yang sering diajukan
File apa saja yang diterima?
MP3, M4A (memo suara iPhone), WAV, OGG dan Opus (pesan suara WhatsApp dan Telegram), FLAC, serta juga video MP4, MOV, dan WebM.
Apakah masing-masing pembicara dipisahkan?
Tidak, teksnya mengikuti alur percakapan tanpa menyebutkan siapa yang berbicara. Jeda diam menandai pergantian paragraf, yang membantu mengenali perubahan suara.
Apakah konverter ini benar-benar gratis?
Ya, tanpa pendaftaran, tanpa watermark, dan tanpa batas jumlah file. Konversi berjalan di perangkat Anda dan tidak membebani kami sama sekali, jadi tidak ada yang perlu Anda bayar.
Apakah file saya dikirim ke suatu tempat?
Tidak. File dibaca dan dikonversi di browser Anda, lalu disimpan langsung ke perangkat Anda. Tidak ada server yang menerimanya.
Apakah ada batas ukuran maksimal?
Batasnya hanya kapasitas memori perangkat Anda. Foto dan file audio tidak akan bermasalah; untuk video berukuran beberapa gigabyte, komputer akan bekerja lebih baik daripada ponsel.
Apakah bisa digunakan di ponsel?
Ya, baik di iPhone maupun Android, melalui Safari, Chrome, atau Firefox. Untuk video, dibutuhkan browser versi terbaru karena menyediakan decoder yang digunakan.
Langkah selanjutnya, dengan AI
Sulih suara AI: teks yang sama dibacakan tiga mesin
Naskah yang sama dibacakan tiga mesin sintesis suara, ElevenLabs v3, MiniMax Speech 2.8 HD, dan OpenAI TTS HD, untuk memilih sulih suara dengan telinga. Alur kerja lengkap, tanpa membuat akun.
Buka alat ini