月費方案享 9 折,優惠碼 NODE10,至 8月31日 止

Imaginode
部落格

2026年8月12日

AI 提示詞怎麼寫?一套真正改變你圖像品質的方法

描述照片而不是描述想法,依照主體、動作、場景、光線、風格來組織,用迭代取代堆字:在 Imaginode 上寫出有效圖像提示詞的完整方法,以及一份誠實的清單,列出提示詞永遠解決不了的事。

描述照片,不是描述想法

模型執行的是描述,不是意圖:把場景當成一張已經存在的照片來描述,要有物件、材質和光線,不要抽象概念。

這篇文章可以濃縮成一句話:圖像模型不懂你的意圖,它只執行你的描述。「一張能讓人信任我品牌的圖」不是提示詞,那是給人看的需求說明。模型既不認識你的品牌,也不知道你對信任的定義。它需要具體的東西:物件、材質、光線。

做一個思考練習。想像那張完美的照片已經存在,而你要在電話裡把它描述給一個人,讓他從一千張照片裡把它找出來。你不會說「一張溫暖的圖」。你會說「一位六十歲上下的女人在明亮的廚房裡笑,雙手沾滿麵粉,穿著藍色圍裙」。要做的轉換就是這個。

從想法轉到照片,光是這個心態上的切換,帶來的進步就勝過網路上任何一份神奇字眼清單。那些到處在賣的「祕密提示詞」,其實不過是寫得好的描述。好消息是,這種寫法練一個小時就學得會。

永遠站得住腳的五段結構

一則好提示詞依序回答五個問題:主體、動作、場景、光線、風格;少掉的每一段,模型都會用最通俗的內容替你補上。

一則紮實的圖像提示詞會依序回答五個問題:誰或什麼、正在做什麼、在哪裡、在什麼光線下、用什麼風格呈現。主體、動作、場景、光線、風格。這不是什麼神聖公式,而是一份檢查清單:少掉的每一段,模型都會用它的統計直覺補上,換句話說就是最通俗的內容。

完整範例:「一位六十多歲的麵包師傅,正把一爐長棍麵包從烤箱裡取出,老派石牆麵包工坊,清晨的暖光從側面窗戶照進來,紀實攝影,35mm」。每一段回答一個問題,彼此不矛盾。這則提示詞會產出各種變化,但方向全都是對的。

對照一下「正宗麵包師傅 傳統 手工麵包 品質」。沒有場景、沒有角度、沒有光線:模型只會把這些字當成一種模糊的氛圍,然後交出關於麵包店這個概念最平庸的插圖。兩則提示詞花一樣的錢。結構是免費的,不拿白不拿。

主體是選角,不是分類

三個看得見的細節就夠了:大概的年紀、一個外型特徵、一件具體的衣物;主體越有血肉,圖就越不像圖庫照片。

「一個女人」是一個分類。「一位四十歲上下的女性主管,短灰髮,酒紅色套裝」是一次選角。差別只在幾個看得見的細節:大概的年紀、一兩個外型特徵、一件具體的衣物。三個選擇就夠了,不需要寫一份戶籍資料。

挑那些對你的圖有意義的細節。如果你要做一篇談手工職人的文章配圖,手比髮型重要:「被工作磨出痕跡的雙手,指甲修短」對模型的引導,遠比眼睛顏色有用,反正在大遠景裡也沒人看得到眼睛。

物件和場所也是同樣的邏輯。「一台車」會給你一台認不出牌子的通用房車。「一台 90 年代的家庭旅行車,褪色的綠色車漆,沾滿泥巴的車牌」已經在講一個故事了。模型很喜歡這種材料:主體越有血肉,圖就越不像圖庫照片。

動作,也就是你的圖為什麼看起來像定格

一個具體的動詞就能解開姿勢,並自然產生構圖;動作要單一主體、看得懂,複雜的互動超出目前模型的能力。

很多提示詞描述了主體,卻忘了給他事情做。結果很好預測:一個人站著、正面對鏡頭、露出證件照式的微笑。如果你的圖全都有那種型錄感,幾乎都是動作那一段缺席了。一個具體的動詞就足以解開姿勢。

「一邊看著窗外一邊倒咖啡」、「皺著眉修腳踏車鏈條」、「在雨中奔跑,把外套舉在頭上」。動作給了模型安排手臂、決定視線、在身體裡製造張力的理由。它會自然產生構圖,你不必自己去描述構圖。

不過要小心涉及多人精確互動的複雜動作。「兩名劍士,其中一人以四分位擋下攻擊」超出了目前模型能乾淨處理的範圍:你會得到不可思議的肢體和融在一起的劍。就停在單一主要主體、看得懂的動作上,至少在你還在用 1 點迭代的階段是這樣。

場景是要營造氛圍,不是清點物品

兩三個挑對的元素就能定位場景:列出十五樣東西只會得到過度擁擠的構圖,而空間層次的指示比形容詞更能建立結構。

場景負責定位並營造氣氛。兩三個挑對的元素就夠了:「餐廳廚房正在出餐,不鏽鋼,蒸氣」就足以召喚出整個世界。不必列出預期中的二十樣廚具,模型對餐廳廚房的認識,比你能描述出來的還多。

和空場景相反的錯誤,是鉅細靡遺的場景。一則列出十五樣物件的提示詞會逼模型全部塞進去,而它會塞得很糟:漂浮的物件、荒謬的比例、擁擠的構圖。如果某個道具真的重要,就在句子裡給它一個位置,否則就交給模型。你在描述一張照片,不是在寫一齣連舞台監督都算進去的舞台劇。

也要想想景深。「背景虛化的書架」把元素放到正確的距離上,順便暗示了淺景深。這類空間指示,前景、背景、透過玻璃看出去,比任何氛圍形容詞都更能建立構圖的結構。

光線,最被低估的一項參數

把光線寫清楚,改善圖像的機率高過任何其他補充:同一家咖啡館,寫下雨的早晨或金色長影,情緒就從憂鬱翻成明亮。

去問攝影師是什麼構成一張照片:他會先講光線,再講主體。圖像模型也一樣。同一個露天咖啡座,在「下雨早晨的灰色光線」下變得憂鬱,在「午後將盡的金色光線,長長的影子」下變得明亮。只是一段句子,整張圖的情緒就翻了過來。

幾個效果很好的方向:日落前的金色光線、把輪廓切出來的逆光、拍人像用的北向窗戶柔光、夜間都市氛圍用的彩色霓虹。需要的時候也說明光從哪裡來:側光會雕出臉部的立體感,正面光則會把臉打平。

如果你只能在現在的提示詞裡加一段,就加這一段。在我們的測試裡,寫清楚光線帶來明顯改善的機率,高過任何其他補充,主要是因為光線會統一整個場景。普通的場景配上漂亮的光線,永遠比反過來好看。

風格收尾,決定成品的樣貌

告訴模型要產出哪一種圖,寫實攝影、水彩或 3D 算圖,再加上焦段或光圈:攝影機節點會替你寫出這些術語。

最後一段:告訴模型它產出的是哪一種圖。「寫實攝影」、「水彩插畫」、「極簡 3D 算圖」、「60 年代網版印刷海報」。少了這一句,模型會自己決定,而不同模型的預設選擇並不一樣。就是這一段,能避免攝影專案裡突然冒出一張水彩。

如果是攝影,幾個技術詞彙立刻見效:一個焦段,35mm 給你紀實感,85mm 拍人像能把主體從背景抽離;一個光圈,例如 f/1.8,可以把背景化開。你不需要懂光學,這些詞就像捷徑,直接通往模型早已滾瓜爛熟的那些成像效果。

在 Imaginode 上,攝影機節點把這部分工業化了:五個附圖的轉盤,景別、鏡頭焦段(毫米)、光圈、角度和運動,會把正確的英文術語寫在你的提示詞開頭。想學的話,轉一轉轉盤,看它產出什麼文字。那是一堂偽裝成介面的攝影詞彙課。

為什麼英文的效果比較好

訓練資料絕大多數是用英文描述的:英文攝影詞彙觸及的學習區域更豐富,所以構圖和光線的掌握也更好。

語言的事我們直說。圖像模型接受中文,也應付得來,但它們的訓練資料絕大多數是用英文描述的。直接的後果是:英文的攝影詞彙,golden hour、rim light、shallow depth of field,觸及的是它們學習中遠遠更豐富的區域,比中文的對應說法(如果存在的話)豐富得多。

這個差距不只是表面。同一個概念用兩種語言測試,英文版本經常產出更有意圖的構圖和掌握得更好的光線,原因很單純:精確的詞彙存在,而且模型看過幾百萬次。「逆光」它看得懂,backlit silhouette 它掌握得住。

那麼是不是得先學會攝影英文才能開始創作?不用,這正是下一節的重點。但理解英文為什麼佔優勢,可以避免你誤以為「AI 不行」,其實限制你結果的只是措辭。

魔術棒,你 1 點的技術翻譯

魔術棒用 Kimi 把你的中文改寫成豐富而有結構的英文,只要 1 點,而且保留你參考人物的 @提及。

在 Imaginode 圖像節點和影片節點的每一個提示詞欄位上,都有一支魔術棒,會用 Kimi 模型把你的文字改寫成豐富而有結構的英文,收費 1 點,大約 0.01 歐元。你寫「一個麵包師傅早上把麵包從烤箱拿出來」,它會用該有的技術詞彙把場景展開:光線、材質、成像。

正確的工作流程:先用中文完整寫下你的想法,五段都寫。按下魔術棒。讀它產出的內容,生成,然後如果某個細節跑掉了,就直接改那段英文。魔術棒不是可以一直重抽的樂透,它是一個翻譯與擴寫的步驟,每個新想法做一次就好。

有個細節對後面很重要:魔術棒會保留你參考的 @提及。如果你的提示詞裡有 @marie,也就是你在參考節點裡定義的常態人物,改寫後提及依然完整,描述照樣注入,照片照樣附上。所以擴寫過的提示詞,和整套參考系統仍然相容。

用迭代取代堆字

一條規則:每次生成只改一個地方,並在節點保留的最近 12 次生成裡比較;十次有紀律的迭代,一次 1 點,總共 0.10 歐元。

面對一張令人失望的圖,人的直覺反應是加字。五個來回之後,提示詞長到八十個字,自我矛盾兩次,而且沒人知道哪一段產生了什麼。這種千層派提示詞是中階創作者最常見的死路,比提示詞太短常見得多。

健康的方法只有一條規則:每次生成只改一個地方。圖太暗?只改光線那一段,重新生成,比較。構圖不滿意?只改構圖。在 Flux Schnell 上一次 1 點,十次有紀律的迭代花 0.10 歐元,而且會讓你學到每個詞的重量。這是一場超便宜的科學實驗。

節點的歷史紀錄讓這種紀律變得輕鬆:最近 12 次生成都看得到,每一張都可以互相比較。把兩個版本並排放著,你會真的看見換一個詞的效果。當某次迭代讓圖變差,就回到前一段文字,換一個方向。什麼都沒丟掉,什麼都可以比較。

負面提示詞不是到處都有

寫你想看到的,不要寫你想避免的:「清晨無人的街道」有效,而「不要人群」可能反而把提到的概念召喚出來。

你會在論壇上看到塞滿「no blur, no extra fingers, no text」的提示詞。那是舊工具留下的遺產,它們有一個獨立的負面提示詞欄位。在 Imaginode 裡能用到的新一代模型上,這種寫法並不是標準:不同模型對否定的理解程度不一,而且提到一個概念本身就可能把它召喚出來。

寫你想看到的,不要寫你想避免的。與其寫「背景不要有人群」,不如寫「清晨無人的街道」。與其寫「不要糊」,不如寫「臉部對焦清晰」。正面的寫法描述的是一張可能存在的圖,否定的寫法描述的是一個模型不一定畫得出來的空缺。

剩下的是那些沒人要的瑕疵:奇怪的手、招牌上讀不出來的文字。沒有任何負面咒語能保證消除它們,這是模型目前的限制,大家都承認。務實的對策:用低成本一直迭代到一張乾淨的生成,或是安排你的畫面,讓手和文字不要出現在前景。

把提示詞的長度配合模型

1 點的 Flux Schnell 偏好短提示詞,而 7 點的 Flux 2 Pro 或 5 點的 Seedream 5 Lite 才吃得下詳細描述:短的打草稿,長的收尾。

不是每個模型都消化同樣密度的文字。1 點的 Flux Schnell 擅長短而直接的提示詞:一個清楚的場景、幾個補充,幾秒鐘就交件。餵它一百字的長篇不會更好,它會略過一半。它是打草稿的工具,就照這樣用它。

像 7 點的 Flux 2 Pro 或 5 點的 Seedream 5 Lite 這類高階模型,比較能運用詳細的提示詞:材質、複雜的光線、細膩的氛圍。這正是魔術棒擴寫過的文字發揮價值的時候。同一段慷慨的描述,會淹沒 Flux Schnell,卻是它們的燃料。

由此得出一套兩階段的方法,也呼應了新手指南的黃金法則:短而便宜地打草稿,長而精確地收尾。先寫短版,用 1 點一路迭代到滿意的構圖,用魔術棒擴寫,再用 5 點或 7 點的模型生成最終版。你的提示詞會和你的圖一起長大。

提示詞永遠解決不了的事

沒有任何文字能保證固定的臉、五根手指的手或一長段可讀的文字:人物一致性靠參考節點和 @提及,不是靠提示詞。

有話直說:有些問題不是在文字欄位裡解決的,硬要在那裡耗,會賠上好幾個晚上。第一個是人物一致性。你可以用二十行描述你的女主角,年紀、臉、痣:沒有參考圖,她每次生成都會換一張臉。這不是你提示詞的問題,這就是模型運作的方式。

答案在畫布的另一個地方:參考節點。你給它名字、描述和照片,然後在任何提示詞裡提及 @那個名字。提及會顯示成綠色,描述會被注入,照片會自動隨著請求送出。像 Seedream 5 Lite 這種 5 點的參考圖冠軍,就是靠它們在不同圖之間維持同一張臉。

其他事情也要一樣清醒:一段在圖裡完全可讀的長文字、保證五根手指的手、忠實重現的註冊商標,沒有任何提示詞能做到。認清這些限制會替你省下大量時間:你會知道什麼時候該打磨文字,什麼時候該換工具。以圖中文字為例,可行的對策只有兩三個字,加上一個撐得住的模型,就像 YouTube 縮圖的工作流那樣。人物一致性其實值得這個部落格上一篇專文

一個完整的前後對照,把一切串起來

同一張遠距工作的視覺,靠五段結構、魔術棒和四次迭代,從通俗的樣板圖變成可信的照片:總共 12 點,一刻鐘。

真實情境:一位創作者要為一篇談遠距工作的文章準備視覺。第一則提示詞,「女人 遠距工作 開心 生產力」。結果很好預測:通用的白色辦公桌、對著電腦的僵硬笑容,一張沒有授權的圖庫照。提示詞描述的是一個概念,模型交出的就是那個概念最平庸的樣板。

第二個版本,套上結構:「一位三十多歲、穿芥末黃毛衣的女性,神情專注,在筆記型電腦前為文件做註記,公寓客廳裡有綠色植栽,上午將盡的柔光從左側大窗照進來,寫實攝影,50mm,淺景深」。用魔術棒擴寫花 1 點,在 Flux Schnell 上迭代四次,最後用 Flux 2 Pro 定稿。

整趟下來的帳單:12 點,大約 0.12 歐元,拿錶算是一刻鐘。最終的圖有可信的光線、自然的姿勢、真正的觀點。沒有隱藏的天分,沒有神奇字眼:五段誠實填好、一次有工具輔助的翻譯、幾次有紀律的迭代。整套方法就在這個例子裡。

你的下一步

拿你最近寫的提示詞用五個問題檢查一次,花 1 點重新生成再比較:接著要顧人物就往參考節點,要顧質感就往攝影機節點。

拿出你最近寫的那則提示詞,隨便哪一則都行。用五個問題檢查它:主體有沒有血肉、動作夠不夠具體、場景有沒有定位、光線有沒有描述、風格有沒有指定。把缺的段補上,在 Flux Schnell 上花 1 點生成新版本,然後在節點的歷史紀錄裡比較兩張圖。那個落差會比這篇文章更有說服力。

接下來看你的專案往兩個方向走。如果你的圖有一個反覆出現的人物,參考節點和 @提及是你的絕對優先,遠比任何詞彙上的講究重要。如果吸引你的是電影感,就去研究攝影機節點和它的五個轉盤,然後看我們談 AI 運鏡的那篇文章

如果你卡在某一則提示詞上,就到右下角的泡泡裡問助理:它看得到你打開的畫布、你的節點和你的文字,1 點就回答你。描述照片而不是描述想法,這件事還是你的工作。其他的,你已經有工具了。

想在真正的畫布上試試嗎?

本文提到的一切,都能在瀏覽器裡用 Imaginode 完成。

開始使用