绘画AI人像出图三要点:五官对称、光影方向、表情自然度
直接给结果:绘画AI人像想稳,别一上来就堆形容词,先抓三件事——五官对称、光影方向、表情自然度。这三样定生死,剩下的风格词都是锦上添花。照这篇的顺序排查,废图率能明显往下掉。
绘画AI人像这事儿,我一开始踩了整整半个月的坑:脸好看,但左右眼总差着那么一点;五官端正了,光又是乱的,像贴上去的。最气人的一张,人物左脸是夕阳暖光,背景却挂着一轮正午的白太阳。后来我干脆不碰风格词了,把问题拆成三块逐个排查,出图率才算稳下来。下面这三招,都是拿废图换来的。
五官对称:先别怪模型,构图和补救时机才是关键
五官对称先靠正面半身构图打底,歪了用局部重绘救,别指望一句perfect face的咒语词能救回来。我实测下来,构图占七成,后期修复占三成。
为什么正脸构图这么重要?因为人像稍微侧过十五度,模型就要自己脑补另一半脸,脑补就可能补歪。我有一阵子痴迷四分之三侧脸,连出三十张,其中九张两只眼睛不在一条水平线上。老实讲,那不是模型的问题,是我在给它出难题。
正面半身像加一个明确的镜头词,比如正面特写或者平视视角,对称率立刻上一个台阶。那如果还是歪呢?别整张重roll,圈出眼睛附近一小块做局部重绘,重绘幅度压到0.3左右,低于这个数修不动,高于0.4容易把眼型改得连亲妈都不认识。这个0.3是我拿同一张图反复试出来的甜点值,你可以从0.28开始往上摸。
还有个省事的歪招:出图时分辨率拉高一点,脸占画面比例大一些,崩脸概率会小。小图里一张脸就几十个像素,模型想画对称也施展不开。顺手再补一个镜头词,八十五毫米人像镜头这类描述,景深一虚,五官上哪怕有细微的不对称也会被虚化吃掉大半。
光影方向:人像质感八成来自这里
同一张脸,光源方向写清楚,质感立刻不一样;提示词里明写侧光、侧逆光,比堆十个画质词管用。光不对,再精致的脸也像塑料。
我见过太多人在提示词里塞高清、细节、8K,脸还是平得像证件照。问题不在清晰度,在光。一张脸的立体感全靠明暗交界,光从哪边来、软还是硬,直接决定这人是活的还是石膏的。
给你几个我反复验证过的写法:窗口侧光,出温柔的自然感;侧逆光,头发边缘会亮起来,人从背景里浮出来;伦勃朗光,就是单侧四十五度的那种打光,脸颊对侧会留一小块三角光斑,电影感最足。写英文提示词的话,soft window light、rim light、rembrandt lighting这三个词组,建议直接存成你的常用片段。
翻车提醒一句:光是写对还不够,得跟背景对上。我那张左脸夕阳、背景正午太阳的图就是教训——人物和背景各画各的。所以提示词里光源描述只写一处,别前后打架,背景描述也顺着同一个光源走。
表情自然度:把「微笑」换成「刚笑完」
直接写微笑,多半收获一张职业假笑;改写成刚笑完、抿嘴忍笑这类状态词,表情立马松弛下来。要抓拍的瞬间,不要摆拍的姿势。
这话怎么理解?你回忆一下证件照和抓拍的区别。证件照是摄影师喊一二三、你把嘴角提起来,肌肉是紧的。抓拍是你刚听完一个笑话,笑意还没完全散掉,那种才是活的。模型也一样,你写smile,它给你摆拍;你写just finished laughing、slight open mouth,它给你抓拍。
我自己的偏好排序是这样的:将笑未笑的状态词排第一,眼神加个看向镜头外排第二,比直勾勾盯着镜头自然得多。第三是嘴部别写太细,什么嘴角上扬三毫米这种词,模型根本不理解,反而容易把嘴画崩。眼神是很多人漏掉的一环,你想想,一个人嘴在笑、眼神放空,那画面立马就假了,所以眼里的情绪和嘴上的动作得配套写。
不夸张地说,把「微笑」这一个词改掉,是我这一年性价比最高的一次调参,废图率肉眼可见地降了。
回到开头那张光乱掉的废图。现在我的流程固定成三步:先正面构图保对称,再写死一个光源,最后把表情词换成状态词。三关都过了,才轮到风格和色调进场。顺序别反,反了就是在给一张歪脸描眉。
常见问题
人像出来了,手还是崩怎么办?
手是另一个世界的难题。最省力的办法是构图时让手部少入镜,或者用花、杯子这类道具挡住。真要露手,圈手部单独局部重绘,幅度给到0.4左右。
侧脸人像这套方法还适用吗?
光影和表情两招照用。对称那条就不强求了,侧脸看的是轮廓线,提示词里补一个侧脸轮廓干净的描述,重点盯下颌线别糊。
设备一般,本地跑得动人像吗?
能,但建议出图分辨率别贪大,先出小图选构图,选中的那张再放大重绘。脸崩多数发生在小尺寸,放大这一步反而顺手把脸救了。