ai绘画迷惑行为答疑:手、光影和那些忽灵忽不灵的词

ai绘画迷惑行为答疑:手、光影和那些忽灵忽不灵的词
ai绘画迷惑场景插画:画师对着屏幕上六指的手挠头困惑

开门见山:ai绘画迷惑基本集中在这几件事——手崩、词不生效、风格漂移、细节每张都不一样。都不是玄学,每个都有对应的参数或写法可治,新手先从负面词和局部重绘下手。

每个玩AI绘画的人,应该都在深夜对着屏幕问过同一句话:它为什么给我画了六根手指?我第一次抽到六指的时候,盯着那张图看了快一分钟,还放大数了两遍——确实是六根,不多不少,画得还挺自信。后来我发现,问出这个问题的人比我多得多,画友群里每周都有人贴六指图求救。那晚的迷惑不止这一个:同一句提示词,昨天出图是水彩,今天就变成厚涂;写好的「侧光」,十张里三张灵七张不灵。这篇把我这半年攒下来的迷惑点一次说清,都是我自己踩过、查过、试出来的答案。

手为什么总是崩的

手崩是因为训练集里的手大多又小又糊,模型压根没学明白手指结构。解法是把手部单独框出来局部重绘,再不行就让人物把手插兜,这是我用得最多的歪招。

我统计过自己9月的58张人像出图:默认参数直出,手崩率三成上下,多指、粘连、关节反折都算。加上负面词再配合局部重绘(幅度0.45,两轮以内),能压到一成左右。剩下的那一成,我一般直接改构图——把手藏进口袋、拿本书挡住、或者干脆裁掉。对,就是骗自己,但这招的交付成功率是百分之百。

为什么会这样?手在照片里经常是远景或者被虚化的部分,模型见过的清晰手部素材太少,学出来就是一团浆糊。这不怪你,也不怪模型太笨,怪它见得少。

有些在线工具现在自带手部修复按钮,一键补手指。我试过其中一款,10张崩手救回6张,剩下4张越补越怪——手指数量是对了,姿势补成了鸡爪。一键功能当急救包行,别当手术刀使,关键图还是老老实实框选区重绘。

提示词为什么忽灵忽不灵

同一个词在不同模型、不同版本里表现完全不同,因为各家训练集不一样。换模型先重测一遍常用词,别拿旧经验硬套,我在这上面浪费过整整一个晚上。

吃过一次大亏。我攒了一份用SD 1.5验证过的词库,换到SDXL之后原样照搬,连抽20张全废——不是废在质量,是废在风格全不对,我想要的赛博朋克霓虹味出不来,出来的全是柔和的插画感。同样的「赛博朋克」三个字,两个模型的理解差出一个次元。

词的权重语法还能解释一部分「不灵」。SD里可以用括号给词加码,带权重的写法比光秃秃写一个词听话得多。我原来不知道有这个语法,一度以为是模型听不懂侧光,其实是它根本没听见。网上不少教程还在用旧版本写法,照抄之前先对一下自己的模型版本。

还有个迷惑点是指令词的强度。CFG拉到12,模型对你的提示词言听计从但画面僵硬;压到7左右,它开始有点自己的想法,画面反而活。词「不灵」的时候,先看看是不是被自己调太死了。

为什么每张图的细节都对不上

种子值不变、提示词不变,出图才会一致;要的是「同一个人」,得靠角色参考或固定角色模型。靠运气连抽是抽不出同一个人的,这钱省不得。

新手最常见的误会在这:以为多抽几次总能撞出同一张脸。撞不出来的。随机性写在这类模型的天性里,种子一换,光线、发型丝、衣褶全跟着变。话说回来,不是所有图都需要一致性——单张海报、头像、壁纸,每张不一样反而是优点,等于开了个无限素材库。做连载漫画和IP形象的时候,随机性才从特点变成毛病。先想清楚你要的是哪一种,能省掉一半烦恼。

我的办法是角色参考功能。9月初给一个虚拟形象连出9张图当表情包素材,服装和发色能对上,脸大概保持七成像,剩下三成靠挑——9张里挑4张能用。想做到十成像,得上专门的角色模型,那又是另一门手艺了。另外说明一句,这类虚拟形象仅限原创设定用,别拿它去复刻真人长相,那是要出事的。

回头想那晚的六指,其实每个迷惑点都有出处:手崩是数据的事,词不灵是迁移的事,细节对不上是随机性的事。迷惑归迷惑,解法都在参数区和写法区,不在玄学区。下次再抽到六指,别怀疑人生,框住那只手重绘两轮——两轮不行,就插兜。

常见问题

六指的图发出去会被一眼认出是AI吗?

大概率会。大众识别AI图的第一眼还是看手,交付前我养成习惯了:把手部逐张过一遍,比检查脸还认真。

提示词里写8K、超高清真有用吗?

分辨率由出图尺寸决定,跟这几个词关系不大。我做过对照,加不加肉眼几乎分辨不出,更多是心理安慰。想让图更细,提高出图分辨率或放大重绘更实际。

锁住种子就能解决风格漂移吗?

只能解决一部分。种子锁住的是构图和随机大方向,风格还得靠提示词里的风格词和参考图一起压,两头都得管。

新手第一步该学参数还是学写词?

我的建议是先学写词。词写对了,默认参数就能出可用的图;词不行,参数调到天亮也是白搭,这是我拿自己的通宵换来的排序。