AI绘画五官总崩?我修了100张脸,总结了这4条
先泼盆冷水:五官崩不是玄学,也不全是提示词的锅,扩散模型对脸部的理解天生就糙。依据是我修过的100张崩脸记录,眼睛和嘴占了问题的大头。先接受这个前提,再按文中的顺序修,别一上来就整张重抽。
我第一次用AI画头像那晚,出来了张挺好看的半身像,放大一看,女孩的眼睛一边大一边小,牙齿还多出一颗。把图发到群里,底下齐刷刷回我三个字:正常。AI绘画五官崩就是这么个绕不开的坎,谁都会撞上。那之后我专门留了个文件夹,专收崩脸的图,修到现在攒了100张,规律比我想象中清楚得多。
五官为什么总崩:模型学的是一张平均脸
AI绘画五官崩的根源,是训练数据里正脸占比小、角度变化大,模型学到的是统计意义上的平均脸,细节全靠现场猜。所以它不是随机坏,是固定在几个地方坏。
我把那100张崩图过了一遍,问题分布相当集中:眼睛不对称或眼神涣散的44张,嘴歪、牙齿画多的32张,鼻子和耳朵轮廓糊掉的24张。手是另一个重灾区,这个很多文章都提过,五官反而是聊得少的。为什么会这样?因为模型看过的图里,人脸大多只占画面一小块,它对「眼睛长什么样」的印象是无数张脸搅在一起的平均值,落到具体一张图上就得靠采样那一刻的运气。
还有个物理原因:远景全身图里,一张脸可能只占不到80乘80个像素,模型根本没多少空间画细节,糊和崩几乎是必然的。
角度也是变量。我后来统计过那100张图的脸部朝向:正脸崩了38张,侧脸和半侧脸62张。侧脸要同时处理两只眼睛的透视差,模型最容易在这儿露馅,四分之三侧脸是重灾区里的重灾区。所以现在我出人像,能要正脸就不为难它,真需要侧脸就做好多修两轮的心理准备。
修脸的正确顺序:先锁图,再动刀
修五官别整张重抽,先锁种子,再按手、眼、嘴的顺序局部重绘,幅度控制在0.3到0.45。这个顺序是我用40多张废图换来的。
具体这么干:第一步,挑一张构图和身体都没问题的图,把种子记下来。第二步,圈住崩掉的眼睛做局部重绘,幅度从0.35起调。第三步处理嘴和牙,最后才是手。我用SDXL跑30步采样,修一只眼睛大概40秒,一张脸全部弄完5分钟以内。
翻车提醒:别贪快。有一次我把重绘幅度拉到0.7想一步到位,结果是脸型整个变了,颧骨都挪了位置,像换了个人。0.5以上就危险,0.3到0.45是安全区,一次修不好就再来一次,每次只改一处。
圈区域的大小也有讲究。我的经验是比眼眶大一圈就够,贴着边缘多留一点余量;圈太大把头发眉毛都框进去,重绘会连发型一起改掉,修完眼睛对了刘海没了,等于白干。上个月帮朋友修三张AI写真,一共动了7处,就是靠着小圈慢修,前后20分钟弄完,成品她直接设成了微信头像。
| 修法 | 耗时 | 实际效果 | 我的评价 |
|---|---|---|---|
| 局部重绘修五官 | 单处40秒左右 | 可控,改哪动哪 | 首选,值得学 |
| 人脸修复插件一键处理 | 几秒 | 快,但容易修出塑料感 | 赶时间才用 |
| 改提示词加面部特写重出 | 15秒一张 | 构图对了基本不崩 | 治本,但要重新抽 |
三种我都常备。真要分个高下:小图应急用插件,正经出图走重绘,要脸的题材直接从构图上解决。
什么图根本不值得修
远景全身图里脸部只有几十个像素,崩是必然,不值得修,直接在提示词里加面部特写构图重出一张。把力气花在放大后能看到脸的图上。
我最早犯的错就是跟远景较劲,一张四人合影里糊掉的脸修了三轮,越修越鬼畜。后来学乖了:凡是需要看清脸的图,提示词直接写上半身或特写,想要场景就画完特写再补一张全景,各管各的。这么调整之后,我的废图率大概降了一半。
那张眼睛一大一小的头像我还留着,存在文件夹第一个,算个纪念。从它到现在,100张崩脸修下来,我最大的体会是:五官崩不是事故,是这个技术的日常,会修比会抽重要得多。工具还会进步,但今天你先把顺序练熟,明天出图就少熬夜。
常见问题
提示词里写精致五官有用吗?
有一点用但别指望。我实测同一句加不加「精致的五官」,崩脸率只从八成多降到七成左右,远不如把构图改成面部特写来得实在。内容词和构图词永远比形容词管用。
人脸修复插件会把脸修得不像本人吗?
会,尤其强度默认值普遍偏猛。我的习惯是强度减半再跑,修完跟重绘前的半身轮廓对一眼,发色、眉形、脸型这三处对得上才算过,对不上就回退走局部重绘。
动漫风和写实风,哪个更容易崩五官?
按我的记录,写实风崩率更高,因为写实脸的结构细节多,错一点就很显眼。二次元脸线条简单容错高,但崩起来是另一种崩法,嘴会飘到脸颊外面,同样得修。
同一句提示词,为什么有时脸好好的有时就崩?
采样带随机性,模型每一步都在概率里掷骰子。想稳定就锁种子:某张脸对了,把种子固定下来只改其他词,脸部质量基本能复现。