替無聲影片配音效
生成出來的影片常常沒有聲音。照著鏡頭描述一段鋪底、開循環,剪輯節點把它鋪在畫面底下:替影片配音這個流程做的正是這件事。
ElevenLabs Sound Effects 從文字做出三個音效:可循環的鐵皮屋頂雨聲、嘎吱作響的城堡大門、爆發的球場。完整流程,不用註冊就看得到。
真實工作流,真實成果。可自由拖曳與縮放。
使用這個工作流真實流程:三個文字節點接到 ElevenLabs Sound Effects 的三個聲音節點,三種不同設定。三個都聽聽看。
重點摘要
你缺的那個聲音,從來不在音效庫裡:門是會嘎吱響,但不是那樣響;雨是會下,但下在瓦片屋頂上。ElevenLabs Sound Effects 會做出你描述的聲音,幾秒鐘、幾分錢。這個流程做三個,一個家族一個:可循環的鋪底、單發的聲音、人群。
音效要用聽到的東西描述,不能用看到的。「雨中的屋頂」是畫面;「大雨打在浪板鐵皮上,水滴進水窪」是聲音。示範的三段指令都這樣寫,而且都以「不要音樂,不要人聲」結尾:沒有這道禁令,模型很樂意加進去。
三個節點的設定不一樣,這正是重點。雨要十秒和循環,才能在較長的鏡頭下無縫轉。門要五秒和較高的文字忠實度。人群要較低的忠實度,讓模型自由發揮。三個聲音一共十美分。
描述聽得到的東西
材質、動作、距離、環境:「沉重的木門在生鏽鉸鏈上嘎吱作響,接著撞上石頭的悶響」。丟掉視覺形容詞,那些聽不見。
設定長度
單發的聲音三到五秒。鋪底十到二十二秒,那是模型的上限。給短聲音太長的時間,模型就會重複它或把它淹掉。
鋪底要開循環
雨、風、嗡嗡的人群、引擎:循環會要求模型讓開頭和結尾接得上。剪輯之後就能無縫重複。
調整文字忠實度
高(0.7)用在你描述得很細的精準聲音。低(0.4 到 0.5)用在讓模型自己補細節的氛圍。示範兩種都有。
同一塊畫布,針對不同需求微調:每個變化版本只要改兩三行提示詞。
生成出來的影片常常沒有聲音。照著鏡頭描述一段鋪底、開循環,剪輯節點把它鋪在畫面底下:替影片配音這個流程做的正是這件事。
點擊、通知、撿到金幣、開門:短聲音、高忠實度,各兩秒。三個節點做三個版本,留下最好的那個。
一場戲背後的雨、嗡嗡的咖啡館、夜裡的森林。二十二秒循環,小聲鋪在人聲底下。指令裡寫出距離:「在遠處」、「隔著玻璃」。
一條龍、一場爆炸、一場雪崩、一艘太空船。用模型認得的真實聲音去描述:吼聲、吐息、隆隆聲、冰的碎裂、渦輪。
準時響起的雷、鐘聲、駛過的火車。每個聲音一個節點,匯出成 MP3,交給音控。全部加起來比一杯咖啡便宜。
如果結果有底噪或雜訊,改善節點的清理模式會把它去掉。很少需要,但要長時間循環播放的聲音值得走這一步。
「秋天的森林」聽不見。「乾葉在腳步下碎裂、樹枝間的微風、遠處一隻烏鴉」聽得見。模型什麼都看不到,它只聽你的句子。
模型很愛給氛圍音披上一層音樂或人聲低語。在指令最後加一句就能擋掉。
一扇門嘎吱響十五秒,就是十五秒的嘎吱聲。單發的聲音三到五秒,長度在節點上設定。
沒開循環,鋪底會有聽得出來的頭尾,剪輯重複時就會露餡。凡是要播得比自身長度更久的聲音,都把它打開。
一到二十二秒,在節點上設定。要更長的氛圍就開循環,讓剪輯去重複那個聲音。
只要沒禁止它就會,尤其是在氛圍音上。所以示範的每段指令都以「不要音樂,不要人聲」結尾。
可以,而且那正是它最強的地方:起飛的太空船、呼吸的生物、魔法的門。用真實的聲音去描述:「渦輪的嘯聲、低沉的隆隆聲、金屬的喀噠」。
依長度兩到三點數,也就是幾分錢。示範的三個聲音一共八點數。價錢在點擊前就顯示在節點上。
MP3,可以從節點下載,也可以直接接進剪輯節點。檔案只有幾百 KB。
它們是為你生成的,別處不存在。ElevenLabs 的條款允許付費帳號的商業使用,而這裡跑的正是付費帳號。
它告訴模型要多照字面跟著你的句子。高,就照描述做,有時會有點僵。低,就在周圍自己補細節,比較生動但比較難預測。
做得到。畫布在手機上能跑,指令在文字節點裡打,聲音在聲音節點裡聽。在手機上創作這篇指南說明操作手勢。