部落格

2026年9月15日

AI 影片的 3D previz:生成前先擬好場景分鏡,完整方法

為何 AI 電影人正從十次失敗的提示詞,轉向只需一次調校的 3D 場景。一個 previz 必須產出哪些內容,才能引導 Seedance、Kling 或 Wan 生成,以及如何在瀏覽器裡完成這一切,不需 3D 軟體,只花幾分錢。

Frank Houbre

Frank HoubreImaginode 創辦人

大家都知道的問題:生成器看不見您心中的畫面

影片生成器能看懂一個攝影機運動,但看不懂文字描述它。3D previz 就是製作出「讓它看見」所需的東西。

您心中已有畫面:一個低角度推軌鏡頭跟著角色走過走廊,鏡頭在他推門時上升,光線灑入。您把這一切寫進提示詞,按下生成,結果模型給您的是一台呆立中央的攝影機、一個朝鏡頭走來的角色,還有一扇根本不存在的門。第二次嘗試,第三次,第十次。每一次都要花 20 到 60 點數,而您仍然無法確定第十一次會成功。

這不是詞彙的問題。像 Seedance 2.5Kling V3Wan 3.0 這類影片模型,完全讀得懂「推軌鏡頭」「低角度」或「35 mm」這些詞。問題在於,這些詞可以對應無數種可能的畫面,而模型只是隨機挑一種。真正能消除這種模糊性的,是一張起始畫面、一張結束畫面,以及,當模型接受時,一段作為動作參考的影片。

這正是 previz 所產出的東西:您分鏡的灰色簡化版本,有真實的體積、真實的人偶角色、真實的攝影機,您只需調校一次,之後所有生成都以此為參考。電影產業三十年來在正式拍攝前都這麼做。AI 影片才剛發現,它其實更需要這一步。

previz 是什麼,不是什麼

previz 不是完成品的 3D 渲染:它是分鏡定位,簡單的體積擺在正確位置,由設好正確參數的攝影機拍下來。

在傳統製作流程中,預視覺化(大家都稱之為 previz)是在正式拍攝前,先用 3D 把分鏡建構出來的步驟。沒有材質、沒有演員、沒有精細場景:牆是箱子,柱子是圓柱,演員是人偶。真正重要的在別處:攝影機在哪裡、用什麼焦段、高度多少、什麼運動、速度多快,以及每一秒畫面中誰站在哪裡。

previz 裡所有的灰色都是刻意的。一旦加上材質,大家就會開始討論材質,而不是討論構圖。previz 的作用是解決場面調度的問題,而它在還不像成片的時候,反而解決得更好。

對 AI 影片來說,previz 還多了一項任務:輸出生成器能讀取的檔案。第一格畫面的清晰圖片,最後一格畫面的清晰圖片,幾秒鐘能精確看見運動的影片,以及用模型能理解的詞彙寫成的分鏡描述。它不再只是討論用的工具,而是提示詞的一半。

一份 previz 必須給您的四件東西

起始畫面、結束畫面、參考影片、結構化提示詞:有了這四個檔案,生成就成了確實執行,而不是一場賭局。

起始畫面固定了第一秒的構圖。所有的圖生影片模型都接受它:這保證了分鏡確實從您決定的畫面開始,角色也在正確的位置。結束畫面則被 Seedance、Kling 和 Wan 接受,固定了最後一秒。中間的過程,模型只需內插出連貫的運動即可,而它在這方面表現得很好。

參考影片就是 previz 的灰色渲染本身,原封不動地使用。有些模型會把它當作動作參考:Kling 3.0 Motion Control 會把一段影片中的動作與軌跡,重現到一張圖片裡的角色身上。這時,您畫出來的攝影機運動,就直接成了渲染結果的攝影機運動。對其他模型而言,它則作為視覺參考與檢查標準:您可以逐鏡逐鏡地比對渲染結果與 previz。

至於結構化提示詞,則用電影語彙描述整個分鏡:時長、比例、攝影機相對主體的起始位置、高度、焦段及其視覺感受(廣角、人像),運動方式(推軌多少公尺、多快的速度,上升多少,平移多少度),角色的動作,氛圍與光線。若手動撰寫,這段文字要花上二十分鐘,而且會有錯誤。若從場景自動生成,則精確無誤,因為它是計算出來的。

所有這些內容都收在一個 zip 資料夾裡,由 Imaginode 的 3D Previz 工作室一鍵匯出,並附上以 JSON 格式記錄的攝影機元資料,供想進一步深入研究的人使用。工作室指南詳細說明了每個檔案的內容。

在瀏覽器裡製作 previz,無需 3D 軟體

一句話就能生成場景,滑鼠處理剩下的一切,渲染完全免費:previz 不再是只有懂 Blender 動畫的人才能使用的工具。

在此之前,製作 previz 意味著要打開 Blender、Unreal 或 Cinema 4D,建模出各種體積,設置攝影機骨架,還要學會製作動畫關鍵幀。對於只想決定一個構圖的人來說,這需要花上好幾週學習曲線。Imaginode 的 3D Previz 反過來解決這個問題:您用一句話描述場景,若有參考圖片也可提供,由 AI 導演在您的瀏覽器中將其建構成 3D 場景。

具體來說,「一條夜間醫院走廊,一名護理師走向盡頭的一扇門,攝影機低角度在他身後」這句話,會產出一條走廊、幾扇門、一個命名好的人偶、冷色調的燈光,以及一台放在角色身後、離地 80 公分、焦段 35 mm 的攝影機。這不是一張生成的圖片,而是一個可編輯的場景,其中每個元素都能被選取、移動與調整。建構費用最低 5 點數,一般約 12 點數(一點數等於一分錢),而且和 Imaginode 上所有地方一樣,價格會在您點擊前就顯示出來。

接著,您就可以進行調校。選取攝影機,挑選 14 到 135 mm 之間的焦段,套用 25 種運動之一(推軌前進、吊臂升降、環繞、揭示、暈眩、手持晃動),或是在地面上逐點點擊繪出路徑。您也可以用飛行模式手動錄製一段虛擬攝影機運動,再將其平滑處理。設定起始畫面與結束畫面。若您更喜歡用說話而非點擊來操作,也可以請 AI 導演「把攝影機後退兩公尺,並換成 50 mm」。

最後匯出:圖片、直接在瀏覽器中編碼完成的 mp4 影片、接觸表、所有鏡頭的分鏡表,以及 AI 套件。這整個過程完全不消耗點數。工作室頁面上作為示範的那隻鳥與熱氣球追逐 previz,正是這樣渲染出來的:27 秒的一鏡到底追逐鏡頭,以 1080p 匯出僅需幾秒鐘。

從分鏡定位到最終渲染:畫布上的完整流程

previz 與生成同屬一個專案:匯出的畫面直接成為 Video 節點的輸入,無需經過您的硬碟。

完整流程分為四個步驟。第一,描述場景,讓 AI 導演為您完成分鏡定位。第二,調校一個或多個鏡頭:攝影機、焦段、運動、角色在時間軸上的位置。第三,匯出該鏡頭的 AI 套件。第四,在 Imaginode 畫布上,將起始畫面與結束畫面接入 Video 節點,貼上結構化提示詞,選擇模型並生成。

至於模型的選擇,規則很簡單。若一個鏡頭中攝影機動作幅度大,且角色有精確的動作,就選 Kling 3.0 Motion Control,並使用參考影片作為動作參照。若一個鏡頭中構圖比動作更重要,就選 Seedance 2.5,搭配起始畫面與結束畫面;若是長達 30 秒的長鏡頭,則選 Wan 3.0。我們的指南如何操控 AI 影片生成器的攝影機逐一比較了各模型的表現。

有一個細節會改變一切:previz 不需要重做。如果第一次渲染結果不理想,您可以更換模型或調整提示詞,但場景、攝影機與畫面本身都會保留下來。您不必每次嘗試都從零開始,而這正是節省點數的關鍵所在。

與「十次提示詞」方法相比,成本是多少

一份 previz 只要一次性花費約十來個點數,而每省下一次影片生成,就能節省二十到六十個點數。

以一個 1080p、10 秒的鏡頭為例。在畫布上,一次 Seedance 2.5 生成大約需要 60 點數,Kling V3 略低一些,Wan 3.0 則依解析度而更高;計算器會顯示當日的確切數值。若需要十次嘗試才能達到理想構圖,那就是 400 到 600 點數,也就是 4 到 6 歐元,而且只是一個鏡頭而已。

有了 previz,場景本身只花約十來個點數,每次訊息調整只需二到三點數,渲染與匯出則完全免費。之後您只需生成一次或兩次,而不是十次。以一部二十個鏡頭的短片來說,這中間的差距可達數十歐元,還能省下大量等待時間。而最重要的理由並非價格:是最終的構圖,正是您原本決定要的那一個。

Higgsfield 於 2026 年 9 月 4 日推出了一款以提示詞驅動的 3D 場景工具,3D Jutsu,採訂閱制。我們在這篇文章中深入探討過它:兩種方法在原則上相似,但在價格、與生成器的整合程度,以及攝影機控制方式上有所不同。

五個代價高昂的 previz 錯誤

一份有用的 previz 應該簡潔、比例正確,並針對將要讀取它的模型來設計。

第一個錯誤:想讓 previz 看起來漂亮。它該做到的是「清晰易讀」。灰色體積加上一個人偶就足夠了;若場景塞滿細節,反而會讓攝影機運動在參考影片中變得不明顯,而模型也會抓住那些沒有意義的細節不放。

第二個:忽略比例。一個人偶身高 1.75 公尺,一扇門高 2.10 公尺,一輛車長 4.5 公尺。若比例錯誤,焦段就會「說謊」,渲染結果看起來會像個模型玩具。Imaginode 的分鏡定位套件會將每個物件放置在其真實大小,而智慧放置功能會把它自動擺放到地面上。

第三個:一台攝影機同時做太多事。在同一個 8 秒的鏡頭裡同時做推軌、上升、平移和變焦,沒有任何模型能跟上這種複雜度。每個鏡頭應有一個主要運動,最多兩個。工作室的 25 種預設運動正是為此而設計的。

第四個:忽略結束畫面。它正是防止模型在鏡頭後半段偏離軌道的關鍵,卻也是大家最常忘記匯出的東西。第五個:沒有為角色命名。在場景中命名為「Léa」的人偶,會在結構化提示詞中同樣被稱為「Léa」,您也可以在畫布上將您的參考角色與之連結起來。

從哪裡開始

一個鏡頭,一句話,一次匯出:十分鐘內,您就能知道這套方法適不適合您。

選一個您從來沒能靠提示詞成功實現的鏡頭。打開 3D Previz,用一句話描述它,讓場景自動建構出來。用滑鼠調整攝影機,直到子畫面顯示出您心中設想的構圖,設定起始畫面與結束畫面,匯出套件。

接著,在畫布上用適合的模型生成一次。與灰色渲染結果比對。若鏡頭效果正如您所想,您剛剛就省下了九次生成。若不然,您也能確切知道哪裡出了偏差,因為您手邊就有一份參考可以對照。這就是 previz 的價值:一份可供評判的參考,而不只是您對想要畫面的一段模糊記憶。

想在真正的畫布上試試嗎?

本文提到的一切,都能在瀏覽器裡用 Imaginode 完成。

開始使用