ai绘画的关键词到底怎么排?主语、画风、镜头的三层写法
一句话版本:ai绘画的关键词,排序比数量要紧。主体写最前,画风居中,镜头和氛围垫底,位置就是权重。顺序对了,词少一半也能出对图。
ai绘画的关键词这个问题,被问得最多的是“该收藏哪些词”,我以前也这么想,存了一整个文档的好词。真正开始批量出图才发现,同样的词,换个顺序,画面重心完全不一样。模型读提示词像人扫一眼句子,靠前的先入为主,靠后的算点缀。想明白这一点,我的出图准确率从三成爬到了七八成,靠的不是加词,是重排。下面把我现在的排法讲清楚,再讲讲位置怎么微调。
位置就是权重,前重后轻要会用
越靠前的词权重越高,主体必须放最前面;想强调的词往前提,想弱化的词往后塞,这是排序唯一要记住的一条。2026年3月我专门做过换序实验:十二个词,一组把“黄昏海滩”放开头,一组把“黄昏海滩”放末尾,各出十张。放开头那组,十张全是海滩当主角;放末尾那组,四张沙滩小得几乎看不见,人物服饰抢了戏。同一个词,位置一换,待遇天差地别。
括号是位置的替补手段。有的工具支持括号加权,但我的习惯是能用位置解决的不上括号——括号一多,整句提示词读起来累,回头改稿自己也晕。真要强调某个词,把它往前挪两位,往往就够了。逗号则是断句,逗号隔开的东西模型会当成并列条目处理,混在一起长串写,模型经常自己脑补出奇怪的组合。
弱化也有弱化的写法。背景里不想要的东西太多细节时,我会把背景词压缩成两三个字扔到句尾,比如“背景:庭院一角”,到此为止。你写得越细,模型越当回事。2026年4月我画一张人物为主的图,背景的描写写了半句长,出来树叶一片片都数得清,人物反而没了气口。把背景砍到四个字,主次立刻归位。删词有时候比加词见效快,这点跟很多人的直觉相反。
三层结构:主体、画风、镜头各管一段
把提示词分成三段:第一段写谁在做什么,第二段写什么画风质感,第三段写镜头角度和光线氛围,段内再按重要性排。我现在的固定顺序是:主体加动作占第一段,风格词、媒介词居中,视角、光线、氛围垫底。举例说,“穿蓝布衫的女孩在檐下收衣服,水彩质感,纸纹明显,低角度仰拍,傍晚侧光”,三段一目了然。出图不对的时候,先看是哪一层出了问题,只动那一层,别的都不碰,改稿效率比整句重写高得多。
三层里最容易被新手写反的是画风和镜头。很多人把“特写、8K、高清”放开头,画质词权重一高,模型就把资源全砸在清晰度上,主体反而糊。我的经验是画质和镜头类词永远垫底,它们是给画面抛光的,不是定内容的。话说回来,这套三层法不是什么发明,就是把人委托画师时的说话顺序原样搬过来:先说画什么,再说画成什么样,最后说怎么拍。
第一段内部也有讲究,我按人、动作、服装、道具这个次序排,重要性递减。人物是画面的锚,先钉住;动作给画面方向;服装和道具是补充。次序一乱,比如道具提到人前面,出图经常道具清晰、人脸潦草。2026年6月我给一组茶具出图,把“青瓷茶壶”写在了人物前面,十张里六张壶是清楚的、人成了虚影。调换之后反过来了,七张人壶都清楚。权重这个东西不讲情面,放前面就是吃资源。
开局没头绪的时候,我有个笨但好用的起手式:先写一句大白话,把画面描述成给朋友讲的样子,比如“一个修鞋匠在巷口打瞌睡”,然后三层各自补两三个词进去。这样长出来的提示词天然带语序,比从词库里东拼西凑再理顺序省事。我带过两个朋友入门,都让她们先这么写,头一天就能出能看的图。词库可以后补,语序的直觉先立起来,后面全是顺水推舟。
说到底,ai绘画的关键词排序练的是克制:想清楚谁才是画面的主角,把最好的位置留给它,其余的词按宾主落座。你下次出图不对,先别急着加词,把现有的词念一遍,多半会发现主角被挤到了句尾——挪上来,问题就好了一半。
常见问题
关键词越多越容易出好图吗?
不是。超过二三十个词,模型开始互相打架,画面会又乱又平。我的习惯是先给十二个词左右出图,看缺什么再补,补一条出一张,别一次全塞进去。
关键词写中文还是英文更准?
看模型,有的对中文理解已经不错,有的英文稳。判断办法很简单:同一个意思两种语言各跑三张,哪边贴合度高用哪边。混写也行,主体用准的那门语言,其他词随手补。
负面词算不算关键词体系的一部分?
算,而且是独立的第三套系统。正面词管画什么,负面词管别画什么,两者不通用。我踩过的坑是把“模糊”放进正面词想要求清晰,结果越写越糊,这类描述状态的词只配进负面栏。
换了模型之后,原来的词序要重排吗?
骨架不用动,三层结构在哪都成立,但权重敏感度会变。有的模型对位置更敏感,有的吃括号。换模型的第一周,我建议只跑换序对照,别的都别调,摸清脾气再说。
怎么判断是词的问题还是排序的问题?
做个换位测试:把可疑的词挪到句首再出两张。挪了之后画面变了,是排序问题;纹丝不动,说明这个词模型压根没理,换词。两分钟就能定案,比瞎猜省事。