提示詞基礎
AI 影像提示詞如何運作:從文字到視覺決策
AI 影像模型看不見你腦海中的畫面,它解讀的是你文字中的關係,再運用它從影像中學到的知識,建構出一個看似合理的視覺答案。當提示詞能夠減少你最在乎的那些決策上的模糊空間時,效果最好。

提示詞是一份提案,不是一句咒語
把寫提示詞想像成尋找完美咒語,是很誘人的想法。但實際上,提示詞更接近一份創意提案。它告訴模型影像裡有什麼、哪裡該獲得關注,以及該用什麼樣的視覺語言來引導結果。
模型會自行補上許多未被說明的細節。當你想要探索的空間時,這很有用;但當缺漏的細節正是這件作品的核心時,這就有風險。如果這張影像必須給人親密的編輯風人像感,而不是精緻的廣告照片感,就要明確說出來。清楚的指示,遠比裝飾性的形容詞更有價值。
模型讀的是關係,不只是名詞
名詞建立的是素材,關係建立的才是畫面。比較看看「一張紅色的椅子和一扇窗戶」與「一張紅色的椅子,在佈滿雨痕的窗前形成剪影」。第二則提示詞給了模型主體、空間關係、光線條件,以及情緒線索。
運用動詞、介係詞與取景語言把各個元素連接起來。像是「倚靠著」、「映照在……之中」、「從……浮現」、「透過……望去」、「緊密裁切」,以及「緊貼著……」這類詞語,往往比再加入另一個物件更有效果。
視覺優先順序能化解模糊性
每一張影像都包含彼此競爭的決策:主體、場景、鏡頭角度、光線、色彩、材質與氛圍。你不需要把每一項都描述出來,只需優先處理其中兩三項,讓影像感覺對了就好。
一個實用的檢驗方式是問自己:「如果這個細節變了,我還會接受這張影像嗎?」如果答案是不會,就把它寫進提示詞裡。如果答案是會,就留一點空間讓模型自己做出有趣的選擇。
- 主體優先:誰或什麼東西是絕不能被誤認的?
- 構圖優先:觀者的視線應該最先落在哪裡?
- 氛圍優先:在被理解之前,這張影像應該給人什麼感覺?
- 製作優先:什麼樣的媒材、成品質感或質地,賦予了這張影像它的身分?
風格是一組可觀察的選擇
「電影感」或「美」這類詞彙,單獨使用時很少能提供足夠的方向。更實用的風格語言,會指出可見的證據:柔和擴散的藍色時刻光線、機頂直閃、35mm 底片顆粒、絹印套色的不完美對位、平面向量的俐落邊緣、具雕塑感的棚拍陰影,或安靜的編輯風版面。
風格不是一個單一的開關,而是由媒材、視角、光線、色彩處理、表面質感,以及後製手法共同構成的。當你把這些部分都描述出來時,模型就能獲得多個一致的訊號,共同指向同一個視覺世界。
反覆迭代能把提示詞變成一套系統
第一次的輸出結果只是證據,不是最終定論。以診斷的角度來解讀它:模型是否理解了主體,卻沒抓到構圖?是否掌握了氛圍,卻把材質做得太過精緻?保留成功的措辭,每次只調整一個重要的變數。
經過幾輪迭代之後,你會建立起一則可重複使用、而不是純靠運氣得來的提示詞——一份清楚的創作方向,能套用到新的主體、宣傳活動,或模型上,同時不失去當初讓它成功的那個核心想法。