← All articles

提示词基础

AI 图像提示词如何运作:从文字到视觉决策

AI 图像模型看不见你脑海中的画面,它解读的是你文字中的关系,再运用它从图像中学到的知识,建构出一个看似合理的视觉答案。当提示词能够减少你最在乎的那些决策上的模糊空间时,效果最好。

Cover image for AI 图像提示词如何运作:从文字到视觉决策

提示词是一份提案,不是一句咒语

把写提示词想像成寻找完美咒语,是很诱人的想法。但实际上,提示词更接近一份创意提案。它告诉模型图像里有什么、哪里该获得关注,以及该用什么样的视觉语言来引导结果。

模型会自行补上许多未被说明的细节。当你想要探索的空间时,这很有用;但当缺漏的细节正是这件作品的核心时,这就有风险。如果这张图像必须给人亲密的编辑风人像感,而不是精致的广告照片感,就要明确说出来。清楚的指示,远比装饰性的形容词更有价值。

模型读的是关系,不只是名词

名词创建的是素材,关系创建的才是画面。比较看看“一张红色的椅子和一扇窗户”与“一张红色的椅子,在布满雨痕的窗前形成剪影”。第二则提示词给了模型主体、空间关系、光线条件,以及情绪线索。

运用动词、介系词与取景语言把各个元素连接起来。像是“倚靠着”、“映照在……之中”、“从……浮现”、“透过……望去”、“紧密裁切”,以及“紧贴着……”这类词语,往往比再加入另一个对象更有效果。

视觉优先级能化解模糊性

每一张图像都包含彼此竞争的决策:主体、场景、镜头角度、光线、色彩、材质与氛围。你不需要把每一项都描述出来,只需优先处理其中两三项,让图像感觉对了就好。

一个实用的检验方式是问自己:“如果这个细节变了,我还会接受这张图像吗?”如果答案是不会,就把它写进提示词里。如果答案是会,就留一点空间让模型自己做出有趣的选择。

  • 主体优先:谁或什么东西是绝不能被误认的?
  • 构图优先:观者的视线应该最先落在哪里?
  • 氛围优先:在被理解之前,这张图像应该给人什么感觉?
  • 制作优先:什么样的媒材、成品质感或质地,赋予了这张图像它的身分?

风格是一组可观察的选择

“电影感”或“美”这类词汇,单独使用时很少能提供足够的方向。更实用的风格语言,会指出可见的证据:柔和扩散的蓝色时刻光线、机顶直闪、35mm 底片颗粒、绢印套色的不完美对位、平面矢量的俐落边缘、具雕塑感的棚拍阴影,或安静的编辑风版面。

风格不是一个单一的开关,而是由媒材、视角、光线、色彩处理、表面质感,以及后制手法共同构成的。当你把这些部分都描述出来时,模型就能获得多个一致的信号,共同指向同一个视觉世界。

反复迭代能把提示词变成一套系统

第一次的输出结果只是证据,不是最终定论。以诊断的角度来解读它:模型是否理解了主体,却没抓到构图?是否掌握了氛围,却把材质做得太过精致?保留成功的措辞,每次只调整一个重要的变量。

经过几轮迭代之后,你会创建起一则可重复使用、而不是纯靠运气得来的提示词——一份清楚的创作方向,能套用到新的主体、宣传活动,或模型上,同时不失去当初让它成功的那个核心想法。