ai绘画公式我拆成五段逐段关掉试了,结果有点意外
我的判断是:ai绘画公式有用,但五段里真正扛画面的是光线段,风格段可有可无,权重括号那段经常帮倒忙。先老老实实照结构抄,抄顺了再按自己的题材做减法,别一上来就背一堆花活。
网上流传最广的那个ai绘画公式——主体加动作加场景加光线加风格,我入门时也照抄过,抄出来的图时好时坏,同一套词今天灵明天不灵。后来我烦了,干脆把它当实验对象拆开:逐段关掉,看画面到底怎么变。结果比我想的有意思,有段词删了反而更好出片。
实验怎么做的:一次只关一段
我用一张雨夜便利店门口的湿毛猫做基准,五段公式逐段删掉,每次各跑二十张,种子和参数全部锁死。变量只有一个,剩下的交给图说话。
基准提示词是我常用的:主体一只淋湿的三花猫,动作蹲着舔爪子,场景雨夜便利店门口,光线是路灯冷白光从左上方打下来,风格厚涂。参数固定,步数28,CFG7,同一种子跑完一组换下一组。二十张一组,五组下来一百张,一个晚上挂队列跑完的,第二天上午逐张标。笨办法,但笨办法有个好处——结论赖不掉。
标图的标准也交代一下,免得你说我的"能挑"太主观。放大到百分百,手指数量对、光源方向跟提示词对得上、猫脸没歪,三条中两条才算能挑。一百张标下来花了三个多钟头,标到最后眼睛都花了,中途起来洗了把脸接着干。数据糙不糙,全看这一步糊弄不糊弄。
哪段一动就变天,哪段删了没反应
光线段一关画面直接塌,二十张里十四张变成平光废图;风格段关掉,十七张几乎没变化。权重括号那段删了,能挑出来的图反而多了一张。
| 关掉哪段 | 画面变化 | 二十张里能挑的 | 我的结论 |
|---|---|---|---|
| 主体 | 5张乱套,猫换成不明生物 | 7张 | 得留着,没商量 |
| 动作 | 12张变站桩,画面死板 | 8张 | 比想象中重要 |
| 场景 | 15张背景漂移成抽象色块 | 5张 | 扛空间感的 |
| 光线 | 14张平光死图,猫像剪纸 | 6张 | 全场最狠,一关就塌 |
| 风格 | 3张轻微变化,骨架没动 | 17张 | 最被高估的一段 |
最让我意外的是权重括号。我以前习惯给主体词加括号加权重,一加加到1.3、1.4,总觉得多多益善。这次对照里我把那套括号全删了,二十张里能挑出来的反而比基准组多一张,猫脸还不歪了。之前有张图猫脸挤成一团,我调了三天,现在回头看,八成就是权重叠出来的毛病。
还有个次发现:关掉动作段的十二张站桩图里,猫的姿势全是四平八稳的坐姿,像证件照。动作词才是让画面有"那一瞬间"的东西,这个词我以前一直当点缀,写的时候随手一放,现在它固定排在主体后面第二位。
拆完之后,我顺手版本的四段模板
主体加动作加场景加光线,四段足够撑起一张图,风格段只在需要统一系列时加。权重括号慎用,非要用别超过1.2。
现在我的模板长这样:一只湿毛三花猫,蹲着舔爪子,雨夜便利店门口玻璃门透出暖光,冷白路灯光从左上方打下来。就四段,逗号隔开。需要出一套风格统一的图,比如给绘本配十张,我会在结尾补一段厚涂、低饱和之类的风格词,单张散图就不加了,加了等于多一个变量。真要用权重,控制在1.2以内,我实测超过这个数,主体容易把画面挤变形,五官先遭殃。
段的前后顺序也有讲究。同一个公式,主体放最前和放最后,出图稳定性差得不少——排在前面的词天然占便宜。我踩过的坑是把光线放最后,结果光源位置十张里飘忽不定,挪到第三段之后稳定多了。
给一个绘本项目配图时这套模板露过一手:十张图靠结尾同一段风格词统一画风,九张一眼就是一个系列,剩下一张光的方向反了,局部重绘两分钟修好。搁在我照抄五段公式的那个阶段,这种活儿至少得多跑一半的量。
拆完这一百张图,我对公式的看法变了:它是脚手架,不是血肉。照抄谁都能抄,关键是知道哪几段在你的题材里扛梁,哪几段是摆设。你手上要是有个常用公式,今晚就可以照这个办法拆一遍,二十张一组,一个晚上挂机,第二天上午就有答案,比到处收藏别人的模板踏实多了。
常见问题
这套分段的公式在所有模型上都适用吗?
四段主干在哪都通用,权重括号的写法各家语法不一样,照搬会报错或者没效果,换模型先查它的语法说明再动手。
五段的先后顺序影响大吗?
有影响。排前面的词权重天然更高,我把光线从末尾挪到中间后,光源位置稳定了一大截。重要的段往前放,别让关键的词垫底。
一组二十张会不会太多,十张行不行?
我头一轮就是十张,结果波动太大,结论拿不准,改成二十张才稳。凑数据这事宁多勿少,反正挂队列跑,人不用守着。
中文提示词也能按四段这么拆吗?
能,分段逻辑不分语言。不过有些模型对英文词响应更好,中文出图发虚时,把关键段换成英文再试,差别肉眼可见。