部落格

2026年10月6日

AI 放大技術:忠實還是創意,放大工具到底發明了什麼

同一張 360 像素的照片,分別用傳統內插、Topaz Precision 和 Topaz Bloom 2 放大四倍,並以 100% 裁切比對。AI 放大工具實際上做了什麼,創意模式何時會改變一張臉,忠實模式何時就已足夠,以及每種方式各要花多少錢。

Frank Houbre

Frank HoubreImaginode 創辦人

放大,就是在十六個像素中捏造出十五個

放大四倍會讓像素數量乘以十六:原始影像中十六個像素裡有十五個根本不存在,而兩個放大工具之間的全部差異,就在於它們如何「捏造」出這些像素。

先看幾個簡單的數字。一張邊長 360 像素的照片共有 129,600 個像素。放大四倍後,邊長變成 1440 像素,也就是 2,073,600 個像素。原始資訊並沒有增加:場景的真實測量值仍然只有 129,600 個,而剩下將近兩百萬個像素,都是必須被憑空捏造出來的。

所以問題從來不是「這個工具有沒有加入細節」。它一定會加入細節,否則影像就只會維持模糊。真正的問題是,這些細節從何而來。是來自對鄰近像素的計算,還是來自一個已經學會清晰紋理長什麼樣子的模型,又或是來自一個會用自己的方式重新繪製場景的模型。這是三種截然不同的做法,放在一張人物照片上,結果也會天差地別。

這正是本文要逐一像素檢視的內容:在一張真實照片上,搭配 Imaginode 提供的兩款影像放大工具,並以任何修圖軟體都有的傳統放大作為對照基準。

三大類放大工具

內插法計算的是平均值,結果是模糊;忠實的超解析度則從影像本身重建出合理的邊緣;而創意放大則用擴散模型重新生成紋理,這種模型可能會改變它所看到的內容。

第一類是內插法:雙線性、雙立方、Lanczos。每個新像素都是其鄰近像素的加權平均值。它速度快、免費,內建在每套修圖軟體裡,而且完全誠實:沒有任何東西是被捏造出來的。但這份誠實的代價就是模糊:原本兩像素寬的銳利邊緣,會變成八像素寬的漸層。

第二類,我們稱之為忠實的超解析度。這種網路是用數百萬組影像配對訓練出來的,也就是同一個場景的低畫質與高畫質版本,因此它學會了如何重建清晰的邊緣、眼睛、頭髮、文字。它會緊貼輸入影像:它的工作是猜出眼前這個東西本該有的清晰樣貌。Topaz Precision 就屬於這一類。

第三類則較為新近。創意放大依賴的是擴散模型,也就是那種能根據文字生成影像的模型。低解析度影像只是給它參考的引導,而它會在上面重新生成紋理。結果往往清晰得令人驚豔,肌膚、布料、材質都栩栩如生。但這個模型並沒有義務忠實呈現它所看到的內容,只需要維持整體的一致性。Topaz Bloom 2 就屬於這一類。

實測:一張 360 像素的家庭合照

同一張模糊的 360 × 360 像素照片,分別用 Lanczos、Topaz Precision 和 Topaz Bloom 2 放大四倍至 1440 × 1440 像素;以下裁切片段皆為 100% 原始比例,未經任何修飾。

我們特意選了一個很難的案例,因為它正是最常見的實際情境:一張小小的舊家庭合照,經過壓縮,有點模糊,裡面有四張臉。如果放大工具要「出賣」什麼,就會在這種情況下現形,而這也正是最關鍵的時刻。

三個版本的尺寸完全相同,邊長都是 1440 像素。以下裁切片段顯示的是父親臉部周圍同一個 560 像素的方形區域,未經任何縮放調整,就如同您在修圖軟體中以 100% 比例放大檢視的畫面。點擊圖片可放大,並用箭頭在不同版本間切換。

傳統放大的結果正如預期:照片變大了,卻沒有變清晰,而原始照片的 JPEG 壓縮色塊變得清楚可見。Topaz Precision 呈現出清晰的臉孔,眼睛清楚可辨,還有三天沒刮的鬍渣,而且這明顯就是同一個人。Topaz Bloom 2 呈現的影像是三者中最清晰的,但卻變成了另一個人。

原始照片:360 × 360 像素,模糊且經過壓縮。此處以放大像素顯示,未經任何平滑處理。
傳統放大(Lanczos)四倍,560 像素裁切,100% 比例。什麼都沒有被捏造,什麼都不清晰。
Topaz Precision 放大四倍,同一裁切區域。邊緣重建,肌膚略顯平滑,五官保持一致。12 點數。
Topaz Bloom 2 放大四倍,同一裁切區域。清晰度媲美攝影棚作品,但下顎、眼神與牙齒都變了,T 恤也變成了有領襯衫。

創意模式究竟改變了什麼,逐一細看

在這張照片中,Bloom 2 改變了父親臉部的形狀、牙齒和眼睛,把 T 恤變成了有領襯衫,把孩子毛衣上的條紋變得規整,還在母親肩上加了一隻手。

把兩個版本並排放在一起,逐項檢視。Bloom 版本的父親臉型變寬了,顴骨不同了,牙齒也重做了,眼神也不再是原本的樣子。他毛衣底下那件淺色 T 恤變成了有領襯衫。原本男孩毛衣上不規則的條紋圖案,變成了一件完美規整的針織衫,彷彿出自商品目錄。畫面左側邊緣,一個模糊的形狀變成了一隻搭在母親肩上的手。

這些改動沒有一個是荒謬的。而這正是問題所在:每一項都顯得合理,除了這個家庭以外,沒有人會注意到。模型看到的是一個三十五歲左右、正在微笑的男人的輪廓,它便非常有技巧地畫出了一個三十五歲左右、正在微笑的男人。只不過,那不是照片裡的那個人。

Precision 也不是完美無缺。肌膚被磨平了,有些地方幾乎呈塑膠質感,小女孩的粉色毛衣上還留著一些奇怪的條紋痕跡,那是壓縮破壞資訊所留下的,背景也依然柔軟模糊。但當它不確定時,它會選擇保持模糊,不會為了填補空缺而捏造出一個物件,而這正是在處理一張真實照片時,我們對工具的期待。

Topaz Precision:毛衣維持原本不規則的條紋,原圖中模糊的手部也依然保持模糊。
Topaz Bloom 2:毛衣變成商品目錄般規整的針織衫,手部清晰,臉孔則被重新繪製成另一個孩子的模樣。

何時該選擇忠實放大模式

只要影像呈現的是某種必須被辨識出來的真實事物,例如一個人、一項產品、一份文件、一個地點,忠實放大就是唯一站得住腳的選擇。

這個原則很容易記住:如果有人會說出「這不是他」或「這不是我們家的產品」,那您就需要忠實模式。家庭合照、客戶肖像、帶有標籤或商標的產品照片、建築師的圖紙、螢幕截圖、檔案資料、案卷文件。在這些情況下,任何被捏造出來的細節都是錯誤,而不是改善。

它也是迄今為止最便宜的選擇。Topaz Precision 按每 24 百萬像素輸出為一個計價單位收費:只要輸出影像在 24 百萬像素以下,一律收取 12 點數,這足以涵蓋一張 1024 像素邊長影像的四倍放大,或一張 4 百萬像素影像的兩倍放大。以每百萬像素計算,它的價格比創意模式便宜十二倍。

對於一張有摺痕、污漬或褪色的老舊損壞照片,單靠放大是不夠的,因為它同時也會把瑕疵一併放大。可行的處理流程說明於修復老舊照片;而如果只是一張單純偏小且模糊的照片,讓照片變清晰則會直接從正確的設定開始。

創意模式何時值得這個價格

當影像沒有需要忠實呈現的真實對象時,例如 AI 生成的影像、插畫、風景、紋理、場景佈置,尤其是準備印製大尺寸輸出時,創意模式就是正確的選擇。

AI 生成的影像沒有原始版本可供對照。那座城堡、那片森林、那個憑空創造出來的角色,在現實中根本不存在,也沒有人能說牆上的石頭「本來不是這樣」。在這種情況下,創意模式的自由度反而成為優勢:它會在生成器留下的平滑表面上補足材質感,而放大到 100% 檢視時,效果提升非常明顯。

同樣的道理也適用於風景、遠景中的建築、背景紋理、繪畫風格的插畫。任何由「材質」而非「身分」構成的內容,都能很好地承受紋理被重新創造。這往往正是一張近看依然立得住與一張看起來像被硬拉伸過的海報之間的差別。

不過,代價也不容小覷。Bloom 2 按每 2 百萬像素輸出為一個計價單位收費,以每百萬像素計算,比 Precision 貴十二倍:一張 1024 像素影像放大兩倍需 34 點數,放大四倍則需 101 點數,此時輸出已達 16.8 百萬像素。它的速度也較慢:我們測試時,一張小尺寸影像耗時 149 秒。而且即使是在生成影像上,也請在確認前仔細檢查人臉:同一個反覆出現的角色,在不同影像中的臉可能會變得完全不同。

沒有任何放大工具能挽回的東西

一張只有三十像素高的臉、明顯的動態模糊、失焦的畫面,或是無法辨識的文字,都是無法被挽回的:忠實模式會讓它們保持模糊,創意模式則會用別的東西來取代它們。

存在一個資訊的下限,任何工具都無法突破。一張在原圖中只有三十像素高的臉,所包含的測量值根本不足以還原出一個真實的人。忠實模式會產生一張模糊、含糊的臉,創意模式則會產生一張清晰但錯誤的臉。兩者都不會還原出正確的那張臉。

文字是最陰險的情況。原圖中無法辨識的招牌、車牌或標籤文字,最終結果要麼維持無法辨識,要麼被改寫成看起來合理但毫無意義的字母,甚至更糟,變成表達了另一種意思的文字。如果文字內容很重要,就應該在上面重新打字,而不是指望放大工具來處理。生成階段也存在同樣的問題,詳見手部與文字,AI 的常見瑕疵。

最後一種情況,是畫面範圍本身。放大工具能讓影像變大,但無法讓視野變廣。如果您需要在兩側補足場景,才能從正方形變成海報格式,那就需要另一種工具:擴展影像能在邊緣加入一致的場景內容,放大則是之後的步驟。

二倍還是四倍:正確的倍率取決於模式

輸出尺寸等於輸入尺寸乘以倍率的平方:四倍放大產生的像素數量是一倍時的十六倍,這在忠實模式下幾乎不影響價格,但在創意模式下會讓價格乘上三到四倍。

點擊前該做的計算是:寬度 × 倍率、高度 × 倍率,然後算出以百萬像素為單位的乘積。一張 1024 × 1024 的影像,放大兩倍後輸出為 2048 × 2048,即 4.2 百萬像素;放大四倍後輸出為 4096 × 4096,即 16.8 百萬像素。一張 2048 × 2048 的影像,放大兩倍輸出 16.8 百萬像素,放大四倍則輸出 67 百萬像素。

在忠實模式下,24 百萬像素的計價單位讓小尺寸影像放大四倍幾乎不用額外付費:一張 1024 像素的影像,無論放大兩倍或四倍都是 12 點數。如果您對最終用途還不確定,不妨直接選四倍。而在創意模式下則恰恰相反:同一張影像,放大兩倍是 34 點數,放大四倍則是 101 點數。請選擇您實際需要的倍率,不要多選一級。

兩種模式都有一個共同上限:輸出 100 百萬像素。超過這個上限,檔案會變得過於龐大,難以順暢處理,而創意模式的價格也會變得不合理。因此,一張 4096 × 4096 的影像無法再放大四倍,因為那會產生 268 百萬像素。至於某種用途究竟需要多少像素,詳細計算方式請見大尺寸列印 AI 影像。

放大應排在最後,絕不放在中途

放大是整個流程中的最後一步:先生成、再修飾、經過確認後,最後才放大最終版本,因為放在放大步驟之後的模型,無法從這些額外的像素中獲得任何好處。

常見的錯誤是太早進行放大。先生成一張影像,因為覺得好看就放大它,接著再修飾,或是把它當作起始畫面送入影片模型。這樣一來,放大所獲得的像素就全部白費了:影像模型會以自己的解析度重新運算,而影片模型無論您給它什麼尺寸的影像,輸出都固定是 720p 或 1080p。

正確的順序永遠不變:先在最便宜的層級進行探索,選定方向,進行修飾,確認最終構圖,然後只放大一次,放大的是真正要進入最終成品的那個版本。這和影片的原則相同,也就是先以低畫質確認內容後再進行放大,詳見4K AI 影片。

在畫布上,這一點一目了然:「增強」節點會接在整條流程的最末端,接在最後一個「影像」節點的輸出之後。如果您在前面的環節做了任何變動,就必須重新執行整條流程,放大步驟自然也會跟著重新進行。相關的基礎概念說明於什麼是 AI 工作流程。

在 Imaginode 上哪裡可以進行放大

共有三個位置:畫布上的「增強」節點,可用於影像、影片或聲音模式;「修飾」節點中每個圖層各自的放大功能;以及透過 Claude 或 ChatGPT 使用 MCP 伺服器的 edit_image 工具。

「增強」節點是主要的進入點。在影像模式下,它提供 Topaz Precision 和 Topaz Bloom 2 兩種選擇,可選擇二倍或四倍放大,按鈕上會在執行前先顯示價格,並依您影像的實際尺寸計算。在影片模式下,它提供兩款影片放大工具,詳見最佳 AI 影片放大工具。

在「修飾」節點中,每個影像圖層都有各自的放大功能,價格相同。這在您用多個元素拼成一張海報時特別方便:您可以只放大真正需要放大的那個元素,而不必處理整份文件。此外,如果您是透過助理工具作業,MCP 伺服器的 edit_image 工具也能在不開啟畫布的情況下完成影像放大。

若想與市面上其他工具比較,例如 Topaz Gigapixel、Magnific、Krea、Upscayl 等,完整的比較內容請見最佳 AI 影像放大工具。

總結

真實的對象用忠實模式,憑空創造的內容用創意模式,倍率依模式而定,放大永遠是最後一步。

一個人、一項產品、一份文件、一份檔案資料:選擇 Topaz Precision,輸出 24 百萬像素以內只需 12 點數,而在一張 1024 像素的影像上,放大四倍不會比放大兩倍多花一分錢。結果可能稍顯平滑,但它絕不會說謊。

一張生成影像、一幅插畫、一個場景佈置、一種紋理,尤其是準備用於印刷時:選擇 Topaz Bloom 2,按每 2 百萬像素計價,因此要節制使用。請在確認前以 100% 比例檢查人臉,如果不需要放大四倍,就優先選擇放大兩倍。

無論如何,請記住放大工具並非萬能:臉部低於三十像素,或畫面有明顯動態模糊時,資訊就已經永遠消失了。在向任何人承諾要「救回」他們的照片之前,最好先認清這一點。

想在真正的畫布上試試嗎?

本文提到的一切,都能在瀏覽器裡用 Imaginode 完成。

開始使用