將影片轉錄成文字

免費、無需註冊,您的檔案不會離開您的裝置。

將檔案拖放到這裡

選擇檔案

沒有任何內容會上傳:一切都在您的瀏覽器中完成

第一次轉錄會下載語音辨識模型,之後瀏覽器會保留該模型:標準精確度約 75 MB,高精確度約 240 MB。影片本身則不會離開您的裝置。

將影片中說的每一句話都轉成文字:採訪、課程、會議錄影,或是您自己拍攝的 YouTube 影片都適用。語音辨識(Whisper,一款 OpenAI 公開發布的模型)在您的瀏覽器中運行:影片不會傳送到任何伺服器,轉出的文字會以段落呈現,方便您校閱。

如何進行轉錄

  1. 1將您的影片或錄音拖放到框內,或點擊選取檔案。
  2. 2選擇輸出格式:純文字 (TXT)、SRT 或 VTT 字幕。系統會自動偵測語音所用的語言,您也可以在設定中自行選擇。
  3. 3第一次使用時,系統會下載一次語音辨識模型,之後就不再需要下載。接下來的處理都在您的裝置上進行:下載文字或字幕檔即可。

關於這些格式

MP4

最通用的影片格式。搭配 H.264 影像和 AAC 音訊時,可在所有手機、電腦、電視和社群媒體上播放。不確定影片會在哪裡播放時,選這個格式最保險。

MOV

Apple 的影片格式,iPhone 和 QuickTime 都使用它。內容其實常常和 MP4 一樣(H.264 或 HEVC),但 Windows、部分網站以及許多剪輯或分享工具都無法接受這個格式。

WebM

網頁上的開放影片格式,採用 VP9 或 AV1 影像加上 Opus 音訊。檔案輕巧,Chrome、Firefox 和 Edge 都能播放,但在 iPhone、剪輯軟體和部分社群媒體上表現較差。

TXT

隨處可讀的純文字:錄音內容以段落呈現,不含任何格式。可直接貼到文件、電子郵件、文章或 AI 工具中。

您的檔案留在您身邊

轉換工作在您的瀏覽器中進行,使用您裝置的解碼器。沒有任何檔案被上傳,也不會保留任何副本,除了您本人,沒有人能看到您的照片或影片。您可以在瀏覽器開發人員工具的「網路」分頁中親自確認:沒有任何檔案被傳送出去。

常見問題

支援哪些語言?

大約一百種語言,包括英文、法文、西班牙文、德文、葡萄牙文、義大利文、阿拉伯文、日文與中文。系統會自動偵測語言;若影片混用多種語言,請在設定中選擇主要語言。

需要多長時間?

在較新的電腦上,通常所需時間比影片本身的長度還短,手機則會花更久。第一次使用時還需加上模型下載的時間,約 75 MB,之後會由瀏覽器保留。請務必校對專有名詞與技術用語。

這個轉換工具真的免費嗎?

是的,無需註冊、沒有水印,也沒有檔案數量限制。轉換在您的裝置上執行,對我們來說沒有任何成本,因此沒有任何理由向您收費。

我的檔案會被傳送到別處嗎?

不會。檔案會在您的瀏覽器中讀取並轉換,然後直接儲存到您的裝置上,沒有任何伺服器會收到這些檔案。

有檔案大小上限嗎?

限制取決於您裝置的記憶體容量。照片和音訊檔案通常都能順利處理;若是數 GB 的大型影片,使用電腦會比手機更有優勢。

可以在手機上使用嗎?

可以,無論是 iPhone 或 Android,在 Safari、Chrome 或 Firefox 都能使用。處理影片則需要最新版本的瀏覽器,因為它需要提供對應的解碼器。

接下來,運用 AI

用 AI 為影片配音,嘴型同步

一段有人說話的影片,換上另一種語言的新聲音:Sync Lipsync 3 會將嘴型重新對齊新的文字。同一個鏡頭,英語版和西班牙語版,不需要重拍。整個工作流程不用註冊帳號就能看到。

開啟工具

其他轉換功能

所有轉換功能