接力的波浪
五個排成弧形的複製體一個接一個慢半拍重做你的動作,像一道波浪掃過整排。這是最好懂的一種處理,動作越單純,效果越好。
你用手機拍的影片送進三個 Wan 3.0 節點,把你複製出去:五個複製體慢半拍重做你的動作、各種大小的你交錯而過、整個大廳擠滿你。
真實工作流,真實成果。可自由拖曳與縮放。
使用這個工作流真實流程:起始影片作為參考接到三個 Wan 3.0 影片節點,每個節點一種複製處理。三段成品就是示範的成品,所有複製體都是同一張臉。
重點摘要
影片複製以前要腳架、固定的背景、拍好幾次,還要一個角色一個遮罩。這裡只要一段手持拍的五秒影片:你拍一下手,跨一步,模型就把畫面填滿你。
示範的三種處理複製的方式不一樣:五個排成弧形的複製體慢一拍接力重做你的動作,像一道波浪;各種大小的你滑過彼此交錯;還有整整一群,從前景肩並肩擠到後牆。
難的不是複製體的數量,而是它們的「忠實度」:只要有一個複製體出來是另一張臉或另一件外套,特效就垮了。所以三段提示都重複,每一個複製體都是同一個人。Wan 3.0 把你的影片當作參考,保住臉、衣著和動作。三段影片需要一百八十點數。
在空曠的地方拍
大廳、停車場、空房間,背景簡單。複製體需要空間,雜亂的場景會讓其中一半躲在家具後面。
一個短而乾淨的動作
拍一下手、側跨一步、揮個手。簡單的動作在複製體之間會重複得很乾淨,一句台詞或一段編舞則會走鐘。
留著那句忠實度的話
每段提示都說所有複製體都是同一個人,連衣服都一樣。就是這句話擋住模型把畫面塞滿一群長得有點像你的陌生人。
三段都生成,再比較
「全部生成」會出三種處理。接力的那段講出一個想法,人群做出效果,大小差異做出畫面:選哪個,看你想說什麼。
同一塊畫布,針對不同需求微調:每個變化版本只要改兩三行提示詞。
五個排成弧形的複製體一個接一個慢半拍重做你的動作,像一道波浪掃過整排。這是最好懂的一種處理,動作越單純,效果越好。
前景巨大的你、後方細小的你、只到膝蓋高的你,用不同的速度滑過彼此交錯。畫面很圖像,接近時尚剪輯的味道,配上節奏明確的音樂很合。
幾十個你從畫面前景一路肩並肩擠到後牆,在同一個瞬間一起拍手。這一種最搶眼,卻也最難讓每一張臉的相似度從前排一路撐到後排。
兩個複製體面對面一來一往,素材是一段你說話的影片。這種短影片格式很常見,前提是起始的動作要非常沉穩,不要一邊說一邊走動。
一位獨立工作者同時在開會、在拍攝、在做客服、在打包出貨。這個畫面三秒說完的事,「關於我」那一頁寫上一整段也未必講得清楚。
一個舞步由整群複製體在同一個瞬間做出來,整齊得像一支隊形。動作要短而明確:拖得越久,後排的複製體越會各走各的節奏。
沙發、桌子和書架吃掉了複製體該站的位置,模型於是放兩個而不是十個。光牆和空地板比漂亮的布置有用。
五秒的編舞會在複製體之間失去同步,變成一群莫名其妙在動的人。兩秒清楚的動作,好好撐住,效果更好。
少了這句話,模型會把畫面填滿一群遠看有點像你的男男女女,複製的效果就消失了,只剩一群普通的人。
複雜的圖案或精細的商標,在遠處的複製體上會壞掉。素色的穿著在重複時撐得好得多,示範用的就是素色。
示範的人群有好幾十個。再多下去,模型會在後排的複製體上丟掉相似度,直式看不太出來,放到大螢幕就看得到。
這可以指定。第一種處理刻意讓它們差零點幾秒,做出一道波浪;第三種則讓它們在同一個瞬間一起拍手。
把兩個人都拍進起始影片,並要求每一組複製體都維持對應的那個人。這比只有一個人脆弱得多,要有心理準備多試幾次。
三種處理合計一百八十點數,每段 720p、帶聲音的五秒影片六十點。只重跑其中一段只要六十點。
節點會連同影片生成音訊,那群人拍手時是單獨一聲響。要精準的成品,就在剪輯時換掉聲音。
可以,剪輯節點在瀏覽器裡把它們組合起來,不花額外點數。十五秒的複製就是一支站得住的影片。
一到十五秒。五秒就夠,而且影片越短,模型丟掉相似度的機會越少。
可以,這套機制並不假定是人。在空走廊裡拍你的狗,並要求忠實的複製體:相似度那道鎖一樣管用。