將影片轉錄成文字
免費、無需註冊,您的檔案不會離開您的裝置。
將檔案拖放到這裡
選擇檔案沒有任何內容會上傳:一切都在您的瀏覽器中完成
第一次轉錄會下載語音辨識模型,之後瀏覽器會保留該模型:標準精確度約 75 MB,高精確度約 240 MB。影片本身則不會離開您的裝置。
將影片中說的每一句話都轉成文字:採訪、課程、會議錄影,或是您自己拍攝的 YouTube 影片都適用。語音辨識(Whisper,一款 OpenAI 公開發布的模型)在您的瀏覽器中運行:影片不會傳送到任何伺服器,轉出的文字會以段落呈現,方便您校閱。
如何進行轉錄
- 1將您的影片或錄音拖放到框內,或點擊選取檔案。
- 2選擇輸出格式:純文字 (TXT)、SRT 或 VTT 字幕。系統會自動偵測語音所用的語言,您也可以在設定中自行選擇。
- 3第一次使用時,系統會下載一次語音辨識模型,之後就不再需要下載。接下來的處理都在您的裝置上進行:下載文字或字幕檔即可。
關於這些格式
MP4
最通用的影片格式。搭配 H.264 影像和 AAC 音訊時,可在所有手機、電腦、電視和社群媒體上播放。不確定影片會在哪裡播放時,選這個格式最保險。
MOV
Apple 的影片格式,iPhone 和 QuickTime 都使用它。內容其實常常和 MP4 一樣(H.264 或 HEVC),但 Windows、部分網站以及許多剪輯或分享工具都無法接受這個格式。
WebM
網頁上的開放影片格式,採用 VP9 或 AV1 影像加上 Opus 音訊。檔案輕巧,Chrome、Firefox 和 Edge 都能播放,但在 iPhone、剪輯軟體和部分社群媒體上表現較差。
TXT
隨處可讀的純文字:錄音內容以段落呈現,不含任何格式。可直接貼到文件、電子郵件、文章或 AI 工具中。
您的檔案留在您身邊
轉換工作在您的瀏覽器中進行,使用您裝置的解碼器。沒有任何檔案被上傳,也不會保留任何副本,除了您本人,沒有人能看到您的照片或影片。您可以在瀏覽器開發人員工具的「網路」分頁中親自確認:沒有任何檔案被傳送出去。
常見問題
支援哪些語言?
大約一百種語言,包括英文、法文、西班牙文、德文、葡萄牙文、義大利文、阿拉伯文、日文與中文。系統會自動偵測語言;若影片混用多種語言,請在設定中選擇主要語言。
需要多長時間?
在較新的電腦上,通常所需時間比影片本身的長度還短,手機則會花更久。第一次使用時還需加上模型下載的時間,約 75 MB,之後會由瀏覽器保留。請務必校對專有名詞與技術用語。
這個轉換工具真的免費嗎?
是的,無需註冊、沒有水印,也沒有檔案數量限制。轉換在您的裝置上執行,對我們來說沒有任何成本,因此沒有任何理由向您收費。
我的檔案會被傳送到別處嗎?
不會。檔案會在您的瀏覽器中讀取並轉換,然後直接儲存到您的裝置上,沒有任何伺服器會收到這些檔案。
有檔案大小上限嗎?
限制取決於您裝置的記憶體容量。照片和音訊檔案通常都能順利處理;若是數 GB 的大型影片,使用電腦會比手機更有優勢。
可以在手機上使用嗎?
可以,無論是 iPhone 或 Android,在 Safari、Chrome 或 Firefox 都能使用。處理影片則需要最新版本的瀏覽器,因為它需要提供對應的解碼器。
接下來,運用 AI
用 AI 為影片配音,嘴型同步
一段有人說話的影片,換上另一種語言的新聲音:Sync Lipsync 3 會將嘴型重新對齊新的文字。同一個鏡頭,英語版和西班牙語版,不需要重拍。整個工作流程不用註冊帳號就能看到。
開啟工具