ai绘画许愿一百次,不如把提示词重排一遍

ai绘画许愿一百次,不如把提示词重排一遍
ai绘画许愿主题插画:金币落入画布许愿池化作漂浮的画作

我的判断是:许愿不灵,多数时候不是模型的错,是愿望本身堆得太挤。词要排序、要给画面主体留位置、还要配负面词。同一句愿望我改了五版做对照,最好的那版抽卡从四十多次降到六次。

你大概也干过这事:把想要的东西全塞进提示词——星空、女孩、白猫、樱花、电影感、8K——然后点生成,抽卡抽到手机发烫。我8月初就这样干了两个晚上,四十多张里能看的只有3张,还都是勉强能看。气得我直接把那句提示词拆开重排,第6张就成了。这件事让我确认了一个判断:ai绘画许愿许不灵,问题多半出在许愿的方式上,不在许愿本身。愿望没错,错的是你把一整张愿望清单念给了一个只会画一张画的人。

许愿式提示词到底错在哪

错在把愿望当清单,一股脑堆给模型,主体被淹在修饰词里。一张图只能有一个视觉重心,清单越长,模型越不知道先画什么。这事跟点菜一样,你对着服务员一口气报二十道菜,端上来的只能是乱炖。

模型读你的提示词,更像读一段绕口令而不是读订单。你写「星空下的女孩抱着白猫,樱花飘落,电影感,8K,杰作,光影绝美」,它的注意力被十四个词拉扯,每个词都想照顾一点,最后每样都给一点:樱花糊在星空上,猫小得像个抱枕,光影不敢放肆做。

还有一类词是纯氛围词,像「8K」「杰作」「超高清」。我在SD里做过小测试,同一句提示词带上和去掉这类词,各抽十张,放一起让我朋友盲选,她挑出来的「更好的一组」和实际有没有氛围词基本对不上。写了不坏,但也没觉得顶事,占的却是主体的注意力。

许愿清单还有一种常见来源:看到别人一张好图,想复刻。我8月中试过,拿着朋友一张国风插画的照片描述去抽,写了二十多个词,抽了三十多张,最像的一张也只有六成像。后来才想通,人家的图里有构图积累和后期调整,这些是提示词装不下的。复刻别人的成图,打根上就是个许不来的愿,想要那个效果,得拆开来学,不是照着念。

同一句愿望,我改成五版做了对照

五版里最有效的一版只做了一件事:主体放最前、场景其次、风格最后,再配四条负面词。抽卡次数从43次降到6次,出图完全不是一个量级。

样本是9月8日到10日抽的,模型SDXL,每轮抽4张,「能用的」按我自己交付的标准算。样本不大,趋势倒是清楚得吓人。要是嫌记参数麻烦,先抄E版那一行,它是五版里性价比最高的一版。

版本改了什么抽卡次数能用的张数
A 原版愿望清单14个词全堆上433
B 删修饰词砍到只剩5个词255
C 主体提前主体挪到句首147
D 分层主体、场景、风格分三段98
E 加负面词D的基础上加4条负面69

最让我意外的是删词的威力。B版什么技巧都没用,光是把「樱花」删了,出图立刻集中——画面里少一个抢戏的,主体就多一分存在感。舍不得删词,可能是许愿党最难过的坎,我自己删的时候也肉疼,毕竟每个词都是我许过的愿。

给愿望排序的一个笨办法

先想清楚这张图里只能有一个主角,然后按主角、动作、场景、光线、风格的顺序写。写完读一遍,删掉跟主角抢戏的词,基本就稳了。

拿我那句原话举例。重排后变成:「抱白猫的女孩,坐在屋顶仰望星空,侧逆光,扁平插画风」。十四个词变十个,画面重心一眼就能看出来在哪。剩下的樱花呢?想要的话放进第二张图里许愿。一张图一个愿望,比一张图塞五个愿望划算得多。

负面词我固定带四条:多余的手指、模糊、低质量、文字水印。人像再加两条。别贪多,我试过一次写十几条负面词,出图整体发灰,模型被我管得束手束脚。

对了,锁定种子值也有人当成许愿技巧来用。我的用法不太一样:种子是定构图骨架的。找到一张七成满意的图,锁住种子、微调提示词,比从头抽省一半次数。把种子当许愿咒语反复念,图只会越抽越像自己。

那天晚上发烫的手机我到现在还没换,不过抽卡已经抽得心平气和了。许愿没有错,谁入门不是从许愿开始的。只是许了一百次还不灵,就该停下来看看那张清单——大概率不是月亮不理你,是你的愿望实在太多了。把清单砍掉一半,再试试。

常见问题

负面提示词一般写哪几条就够?

我的固定四条是多余的手指、模糊、低质量、文字水印,画人像再加上畸形的手和脸部瑕疵。先从少写起,出图不对症再加,别一上来堆十几条。

Midjourney也要这样排序吗?

要,它对词序比SD还敏感。MJ没有负面词输入栏,用no参数,我一般只放两个词,放多了它也会束手束脚。

抽多少次还不出图就该换思路?

我给自己划的线是15次。15次还出不来,回去改提示词,别跟模型较劲——较劲的成本是一晚上的电费和耐心。

提示词写英文比中文准吗?

我的实测是SDXL能听懂中文大意,出图方向不会错,但细节词用英文更听话,比如侧光就不如side lighting指得准。混着写是常态。