一個人配好幾個角色
三個聲音的故事、一段對話、一齣廣播劇:所有台詞都你演,一個角色一個目標聲音、一個節點。演法處處是你的,只有音色在區分角色。
一句由男聲說出的話,交給 ElevenLabs Voice Changer 用三個聲音重說,一位女性、一位年輕男性、一位年長男性,保留原本的節奏和語調。不用註冊帳號就能看到完整流程。
真實工作流,真實成果。可自由拖曳與縮放。
使用這個工作流真實流程:同一句話進入三個增強聲音節點,各自設定一個目標聲音,你聽得到什麼變了、什麼留下。
重點摘要
手邊只有一個聲音卻要配一個角色、想讓旁白更低沉或更年輕、想把一則語音訊息匿名化:變聲器用一段普通的錄音就能做到這些。這個流程把它送進 ElevenLabs Voice Changer,三個目標聲音並排,一次聽出它改了什麼、留了什麼。
留下的正是要緊的部分:節奏、停頓、遲疑、語調。變聲器不改寫句子,它用另一種音色重說。示範句子有一個問句、一個停頓和一個收尾,三個聲音一模一樣地重現它們。這不是語音合成:這是你的演出,換了一副喉嚨。
二十一個 ElevenLabs 聲音可選,沒有個人聲音:這工具是變裝,不是複製。你的檔案從節點的匯入按鈕進來,每次最長十分鐘,按秒計:十二秒的句子用三個聲音要三十二美分,每個聲音九點數。
錄下或匯入那句話
手機的語音備忘就夠了。用你希望它被說出的方式來說:變聲器抄的是演法,不是字。乾淨的錄音給乾淨的結果;吵雜的背景先清理。
選一個目標聲音
節點的選單裡有二十一個聲音,女男老少。每個節點帶自己的一個:同一來源三個節點,三個候選拿來比。
聽節奏,不聽音色
音色會是你選的聲音的,這是確定的。要評的是演法的忠實度:收尾前的停頓還在嗎,問句還往上揚嗎?
送進剪輯或下載
節點的輸出可以接到剪輯或另一個處理。配音的話,一個角色一個聲音,各在自己的節點裡。
同一塊畫布,針對不同需求微調:每個變化版本只要改兩三行提示詞。
三個聲音的故事、一段對話、一齣廣播劇:所有台詞都你演,一個角色一個目標聲音、一個節點。演法處處是你的,只有音色在區分角色。
想公開卻不想讓人認出當事人的證詞。聲音整個換掉,情緒和節奏留下:比放慢或扭曲的聲音誠實,也好聽得多。
覺得自己的聲音對敘事來說太年輕或太尖:用 George 或 Roger 重說。你保留咬字和沉默,得到你沒有的音色。
最輕鬆、也最常見的用法。用小孩或老人的聲音說的生日訊息,字和笑聲都是你的。記得說明這是玩笑:聲音很像真的。
在影片裡說話的品牌角色:自己錄下句子,永遠過同一個目標聲音,角色在每支影片裡都保持同一個聲音。
如果你根本沒有錄音,你要的是旁白流程:它從文字生成朗讀。變聲器永遠從人的聲音出發。
變聲器不會重現拿來當範例的聲音。二十一個聲音全都是 ElevenLabs 授權的,沒有真人。想要「某某的聲音」超出這工具做的事,也超出它該做的事。
雜音不會被轉換,它原樣留在一個已經變了的聲音底下:對比讓它比之前更明顯。先清理,再變聲。
變聲器不會替你演:單調的朗讀給出單調的目標聲音。所有演出都得在原始錄音裡,是它在指揮。
變聲器是為說話設計的。唱歌時它有時守得住音準,常常守不住,背後的音樂也會壞掉。一首歌要先做分軌。
不行,而且是刻意的。變聲器用有授權的 ElevenLabs 聲音之一重說你的錄音;它不學新聲音,也不重現真人的聲音。要變裝,可以;要模仿某個人,不行。
它保留你的發音和語調,所以口音大致都在:變聲器不碰說字的方式,只碰音色。重的口音在另一個聲音裡還是重。
雜音會一起進到新聲音裡,而且更明顯,因為音色變了而雜音沒變。先用清理一段錄音流程清乾淨,再變聲。
每分鐘四十二點數,按秒算。示範句子十二秒跑三個節點,二十七點數,每個聲音九點。價錢在點擊前就顯示在節點上,依你檔案量到的長度計算。
每次十分鐘。長錄音在剪輯裡切段,也方便只重跑改過的那段。
全部:變聲器不懂字,它轉換的是聲音。日文或阿拉伯文的句子出來還是日文或阿拉伯文,發音一樣。
做得到,而且這正是最自然的用法:手機錄的語音備忘,從手機版畫布匯入節點。在手機上創作這篇指南解釋操作手勢。
不會。你上傳的留在你的工作空間,不交給任何訓練,也沒有任何聲音會從你的檔案裡被學走:變聲器只有它那二十一個聲音。