ai绘画逻辑拆解:主体、场景、风格、参数四层谁优先
我先讲明白:ai绘画逻辑的关键不在词堆得有多满,而在主体、场景、风格、参数这四层的排序。主体最先锁定,参数垫底,顺序一乱画面就崩。想写稳提示词,先按这个骨架排好位,再一层一层动手调。
ai绘画逻辑里最容易被忽略的一条:模型读提示词基本从前往后,越靠前的词拿到的权重越高。我跑了多组对照,结论很直接——主体放最前,场景第二,风格第三,参数类词收尾。这不是玄学,是注意力权重分布决定的。
为什么这件事值得单开一篇。因为多数人画面崩了,第一反应是堆负面词、加步数,往参数层使劲。可我实测下来,八成的崩坏出在前三层的排布上,参数背的锅比想象中少。下面把四层拆开讲,每层管什么、怎么排、出问题先动哪。
四层各管什么:先认领,再谈优先级
主体管画什么,场景管在哪发生,风格管长什么样,参数管画质底线,四层优先级从前往后递减,顺序不能颠倒。
主体层是第一优先。一张图里你最不想变的东西,人是谁、拿什么、什么发色,全在这层。它放句首,权重天然最高,被后面的词带偏的概率最小。
场景层排第二。地点、时间、天气、光源,写一两个信息点就够了。我吃过亏:有次把「雨夜便利店门口、玻璃反光、积水倒影、霓虹招牌」全塞进去,主体的白发被霓虹染成粉绿色,10张里3张变成粉发。砍到只剩「雨夜便利店门口」两个点之后,发色立刻稳了。
风格层排第三。胶片颗粒、厚涂、赛璐璐这类词决定质感,但它的位置很敏感,压在句尾常常吃不到权重,后面实测会讲。参数层垫底,步数、采样器、CFG 这些只影响精细度和稳定度,救不了构图,也救不了发色。
下面这张表是我自己排查时用的对照,直接照着症状看就行。
| 层级 | 典型词 | 优先级 | 出问题的症状 |
|---|---|---|---|
| 主体 | 白发女孩、手持透明雨伞 | 最高,放句首 | 换人、丢道具、发色漂移 |
| 场景 | 雨夜便利店门口、暖色灯箱 | 次高,一句话内 | 背景串场、光源打架 |
| 风格 | 胶片颗粒、柯达暖调 | 中等,位置敏感 | 质感不上身,像默认模型 |
| 参数 | steps 28、CFG 7、高清修复 | 垫底,收尾 | 只糊不崩,糊不救构图 |
一手实测:调乱顺序,崩图率真的会翻倍
同一组提示词各跑10张:按主体-场景-风格-参数排序能保住8张主体正确,把参数词提到句首后只剩3张,还搭进去2张发色。
具体说下实验。基准提示词是「白发女孩,手持透明雨伞,雨夜便利店门口,胶片颗粒,暖色灯箱,steps 28,CFG 7」,固定种子跑 10 张,8 张的白发、雨伞、便利店三个要素全对。我试了下把「steps 28, highly detailed, 8k」提到句首,其余不动,10 张里只有 3 张主体全对,还有 2 张白发直接变黑发。说实话,这个差距比我预想的还大。
风格层的位置我也单独测了一轮。「胶片颗粒」压在句尾时,10 张里只有 4 张能看出明显的颗粒质感;挪到场景词后面,涨到 7 张;再给它加权重写成 (film grain:1.2),涨到 9 张。个人觉得加权重这招对风格层特别好使,比反复换词省事。
那参数层是不是完全不重要?也不是。步数低于 20 的时候,哪怕顺序全对,脸部也容易糊。我的习惯是步数 28 起步,CFG 7 上下微调。但要把话说清楚:参数决定的是及格线,前三层决定的才是这张图到底是不是你要的那张。
把四层写成可复用的骨架,崩了按层排查
可复用骨架等于主体一句加场景一短句加风格词两三个加参数收尾;排查时一次只动一层,跑两张再决定下一刀。
骨架写起来很快:主体一句话写全(人物、动作、手持物),场景压缩到两个信息点,风格词挑两三个放在场景后面,参数收尾。整套下来一行半,比堆三十个词的大杂烩出图稳得多。我现在的固定模板就是这个结构,换题材只动主体和场景两段。
排查也有固定次序。第一步看主体对不对,不对就检查主体词是不是被挤到了后面;第二步砍场景,信息点从一个减到零再试;第三步换风格词或者给它加权重;最后才轮到参数。一次只动一层,跑两张看结果。层层一起改,你永远不知道是哪一刀救了它。
话说回来,这套逻辑也有边界。模型越新,对语序的敏感度越低,有些新架构你乱排也不太崩。但主体靠前这个原则,我到现在还没遇到过反例,保底照做不吃亏。
回到开头那句:ai绘画逻辑拼的不是词量,是排序。主体、场景、风格、参数,四层从前往后,权重从高到低,崩了就按这个次序一层一层往下查。下次出废图,先别急着加步数,看看是不是顺序乱了。
常见问题
负面提示词算第几层?
我把它归到参数层的延伸。它管剔除不管塑造,比如去掉多余的手指、水印,管不了你想要什么。正面的四层没排好之前,负面词写得再长也救不回来。
权重语法是不是万能的?
不是。我在主体层基本不用,怕把姿态拧歪;风格层用得多一些。能靠换词解决的,就别上权重,权重叠多了画面容易脏。
不同模型这套优先级还成立吗?
大方向成立。新模型对语序没旧模型那么敏感,但主体放句首、参数收尾这个骨架在哪都稳,迁移成本为零,先按它写不会错。
场景写得越细是不是越出效果?
恰恰相反。场景信息点超过两个,主体就开始被背景词分走权重,我那次粉发事故就是这么来的。要氛围,宁可给光源词,也别堆一堆静物清单。