ai绘画口风说的就是嘴:嘴巴总画崩的原因和修复落点实测
我的判断是:ai绘画口风这个说法里的口就是嘴部,而嘴是整张脸最容易崩的部位,干预顺序比工具更重要。先在提示词里写明闭嘴,压掉大半崩法,剩下的交给局部重绘,最后才手动收尾。我统计过一百张样本,按这个顺序走,崩嘴率能从三成压到一成以内。
ai绘画口风这个词,多数人搜的其实是嘴部画崩怎么办。为什么单独把嘴拿出来说?因为眼睛崩了还能靠发型和滤镜遮,嘴一崩整个人的表情就垮了,观感杀伤力最大。我自己是被人像图里那排大白牙刺激到才认真研究这件事的:笑容灿烂,牙齿像一块刷了白漆的砖头,笑意全无。那张图构图、光影、发丝全都到位,我舍不得扔,卡在嘴上反复折腾了快一个小时,从那天起我就决定把嘴部当成独立课题来研究。后来我专门抽了一百张人像做记录,每张都记下表情类型和崩法,把崩嘴的形态和救回来的办法整理成了一套顺序,写在这篇里。
嘴巴为什么这么容易画崩?
嘴是面部变形幅度最大的部位,张合、抿、咧的状态差异太大,模型容易取到一个含糊的平均值,细节就崩了。我那一百张样本里,崩法集中在三种:一是露齿笑时牙齿画成一整排白砖,没有牙缝没有弧度;二是上下唇边界含糊,颜色晕成一团,像没洗掉的口红印;三是嘴角和脸部中线错位,脸明明正着,嘴却微微歪向一边。露齿笑是重灾区,样本里凡是提示词带笑又带牙的,崩掉的比例超过一半。
闭着嘴的图情况好得多,嘴唇只是两片简单的形体,模型应付得来。这给了我第一个结论:能把嘴藏起来的场合就别让它出来,这不是逃避,是把力气花在刀刃上。还有个观察,侧面脸的嘴比正面稳,因为侧面嘴唇只剩一条弧线,没有上下唇的分层难题,需要侧脸构图时可以放心用。样本里二十几张侧脸只有一张嘴出了问题,这组数据让我后来画侧颜人像时几乎不再检查嘴部,省下的检查时间都拿去盯手了。
至于崩嘴的根本原因,我翻过一些讨论,比较一致的说法是训练图片里嘴部状态太杂,模型学到的是各种嘴的平均混合体,一旦要求具体表情,细节就露馅。这个解释跟我的体感对得上:越是常见的、模糊的嘴越稳,越具体越容易翻。我把样本按提示词长度重新分了一组对比,嘴部描述超过十五个字的那批图,崩嘴率比只写状态词的那批高出一截,数据摆出来之后我就再没在提示词里细描过嘴唇。
修复的落点怎么选,按什么顺序来?
三个落点按成本从低到高排:提示词锁闭嘴、局部重绘只框嘴周、最后才手动修图,能在前一步解决的别拖到后一步。第一个落点最省事,我在提示词里固定加一句闭嘴微笑,一百张样本里崩嘴率从三成掉到百分之八左右,几乎零成本。想画笑又怕牙崩的,把"牙齿"这个词从提示词里删掉,只写轻笑或者抿嘴笑,模型自然会给你一个含蓄的表情,比赌它画好牙靠谱得多。
确实需要张嘴表情的时候,走局部重绘。框要只框嘴周一小块,别贪大把鼻子下巴都圈进去,重绘幅度放在0.4附近,太低改不动崩法,太高连脸型都给你换掉。我试过框大半个下半张脸,修完嘴是好了,下巴却变窄了一圈,前后像两个人,只能整张重来。框小一点、多跑两轮,比一次贪快划算。
前两步都救不回来的,才动修图软件。牙缝用加深工具轻轻补两条竖线,唇线模糊就用小笔描一下边界,歪嘴角用液化推回中线。这些手工活听着粗糙,实际每张只要两三分钟,而且修完的嘴比AI硬改的更贴合原画面,光影的过渡都是顺着原图走的。我救回来的图里,靠手动收尾的约占四分之一,都是构图特别好舍不得扔的。顺带一提,修嘴的最佳时机是出图当天,隔几天再回头看,我对崩点的记忆就模糊了,框来框去反而更慢。
这套顺序跑熟之后,嘴部问题从我弃图的第一原因降到了小瑕疵级别。说到底,崩嘴不是什么玄学,是模型在细节密度和状态多样性上天然的短板,你越早接受"能闭嘴就闭嘴、要张嘴就准备修"这个设定,出图的成品率就越早稳定下来。
常见问题
为什么写了"精致的嘴唇"反而更容易崩?
描述越具体,模型要合成的细节越多,翻车面越大。嘴部描述宜粗不宜细,控制状态比堆形容词管用。
局部重绘修嘴要框多大范围?
嘴唇外扩一圈就够,把鼻子和下巴留在框外,重绘幅度0.4上下,一轮不行跑两轮,比大框一次到位稳。
闭嘴写英文还是中文提示词好?
看你用的工具吃哪套,多数模型对英文closed mouth响应更稳定,中文写"双唇轻闭"也可以,两种都试一次就知道了。
手动修嘴需要绘画基础吗?
不需要,加深、描边、液化三个工具就够用,都是对着崩点做小修小补,练五六张就有手感了。