有人搜"_人物绘画ai"?单人立绘从草稿到成图,脸手衣褶背景四处避崩

有人搜"_人物绘画ai"?单人立绘从草稿到成图,脸手衣褶背景四处避崩
人物绘画ai入门:单人立绘从草稿到成图的四步避崩流程示意

直接上流程:单人立绘按构图线稿、光照基调、脸部细化、手部单独修、衣褶补笔、背景收尾这六步走,崩图率能压到最低。脸和手是重灾区,靠局部重绘而不是整图重跑;衣褶写材质加受力,背景最后加。新手先从半身像练起,别一上来就画全身带场景。

在搜索框敲"_人物绘画ai",出来的多半是一些不沾边的页面——其实你想弄清的大概率就一件事:用AI画单人立绘,到底按什么顺序走才不容易崩。结论先放这里:先定构图和光照,再磨脸,手切出来单独处理,衣褶靠材质描述,背景压轴。这个顺序反不得。

为什么这么笃定?上个月帮朋友出一张法师立绘,我脑子一热把背景先做满了。结果改脸的时候,修复笔刷一抹,后面那座塔楼直接糊成一片紫色的雾。四张图、两个钟头,全打了水漂。教训是疼的,但真管用。

从草稿到成图,这六步顺序为什么不能乱

顺序定成构图、光照、脸、手、衣褶、背景,一共六步,前两步定下整张图的骨架,后面每一步的返工成本才压得住。听着像套话?你试一次"背景先行"就懂了。

第一步别急着堆细节。分辨率先按 768x1152 起步,采样步数拉到 25 左右,用偏低的步数一口气出十来张小图,只挑构图:人物在画面里占多大,视线朝哪边,留白给谁。这一步图丑没关系,丑图才便宜,挑中了再谈别的。

第二步定光照基调,就是一句话的事:逆光的暖橙,还是侧光的冷灰。这句话要一直留在提示词里,后面每轮重绘都带着它,不然色调会一轮一轮地漂。我自己吃过亏,改了三轮脸,光从黄昏漂成了大中午,人物像换了个时辰拍的。

脸和手是第三、四步,单独说。衣褶排在第五,因为布料要跟着身体的结构走,人物没定稿就补褶子,等于给没砌好的墙贴瓷砖。背景永远最后,而且要给自己留一条退路——背景崩了就整块虚化掉,景深一拉,谁也看不清细节。这是最省钱的一招。

位置典型崩法处理方式重画上限
双眼不对称,牙糊成一团局部重绘,幅度 0.35-0.53 次,不行就换种子
六根手指,指节拧成麻花裁出来单独高清修复5 次起步,正常
衣褶褶皱方向打架,布料像塑料写材质加受力,不堆画质词2 次
背景透视跟人的站位对不上最后合成,崩了直接虚化1 次

表里那个"重画上限"是我给自己立的规矩。数字到了就停手,换思路,不再跟同一个种子死磕。跟一张图耗二十轮的人我见过,最后出的图还不如重开一张的。

脸和手为什么最容易崩,怎么救回来

脸崩是五官在草稿阶段只占几十个像素,手崩是模型见过的手部姿态远少于脸,两处都得切出来局部重绘单独伺候,整图重跑是下策。

先说脸。全图分辨率再高,草稿阶段脸部也就百来个像素,模型是"猜"出来一张脸的,猜歪很正常。所以别在整图上磨,框住脸做局部重绘,重绘幅度从 0.4 起调:低一次,五官跟原图接不上;高过 0.55,画风又容易跳。0.4 到 0.5 之间多试两档,大多数脸的问题都落在这个区间里。眼睛不对称这种细节,可以再把框缩小到只剩眼部,幅度压到 0.3 左右,一次一小步。

手是另一回事。手在画面里占比小、姿态又千变万化,模型见得少,出错是常态不是意外。我的做法简单粗暴:把手部区域裁出来,放大两倍单独重绘,画好再贴回去。提示词里老老实实写清楚持物和手势,比如"右手握着一根木杖,五指自然弯曲",比写十个画质词都顶用。崩手这个话题展开讲能写一篇长的,之前整理过一篇 ai 绘画手势崩手的专门拆解,卡在手上的可以先去补课:ai 绘画手势崩手

说个真事。那张法师图,持杖的左手我重画了七次,六根手指、四根手指、指头粘成一坨,什么姿势都见过。第七次我换了个思路,不再写"手持法杖",改成"手搭在杖头顶端",受力点一变,一把就过了。手崩到怀疑人生的时候,先想的不是换模型,是换个动作。

衣褶和背景的坑,全藏在措辞里

衣褶要写材质加受力,比如被风吹起的亚麻斗篷,光堆画质词救不了布料;背景放最后做,跟人物分开处理,景深靠虚化兜底。

衣褶崩,多半是提示词里只有"beautiful dress"这类空话。布料是有性格的:亚麻硬,褶子宽而少;绸缎滑,高光是一条一条的;棉布软,褶子碎。先定材质,再定受力——站定的人,褶子往下垂;走动的人,褶子往身后飘。两个词一对上,八成的塑料布问题就解决了。改不动的时候,把"flowing fabric"删掉试试,这个词反而容易让布飘成果冻。

背景的坑在透视。人站的地平面和建筑的消失点对不上,人物就像浮在半空。所以背景描述里少用大场面词,"简单的石墙走廊,暖色光"比"宏伟的中世纪城市"稳妥十倍——字越少,模型发挥的空间越小,翻车点也越少。真要复杂场景,就把背景当独立的一层来做,人物抠出来贴上去,边缘用一圈柔光过渡。

深色衣服还有个隐藏陷阱。黑袍吸光,跟暗背景糊在一起,人物轮廓直接消失。这时候要么在提示词里给人物后面垫一圈轮廓光,要么干脆把背景调亮半个档。处理黑袍这类深色立绘的提亮思路,我之前单独写过一篇,可以直接参考:黑袍人物提亮

顺带跑个题。我后来发现,最难的不是哪一处的技术,是舍得——舍得把画了四十分钟背景整块虚化,舍得把第七次还崩的手换成插兜。AI绘画跟摄影有点像,好照片是删出来的。

回到开头那个带下划线的搜索词。你真正要的其实就一句话:单人立绘不靠运气,靠的是固定的顺序和每个位置的重画纪律。构图光照先定骨架,脸和手局部重绘单独伺候,衣褶写材质加受力,背景最后做、崩了就虚化。下次开图之前,把这张表在心里过一遍,废图至少少一半。

常见问题

出图分辨率调得越高,脸就越不容易崩吗?

不是。分辨率过高反而容易出现双头、长脖子这类结构崩坏,因为画面容纳了太多模型没规划过的区域。768x1152 出图,然后用高清修复放大一到两倍,比直接开 1024x1536 稳得多。

自动修脸插件一键就补好了,还要手动局部重绘吗?

插件适合批量活儿,速度快但画风经常跟原图对不上,脸修完像换了个人。成图要发出去的,我建议还是手动框选重绘,幅度 0.4 左右慢慢调,可控性完全不是一个量级。

提示词里写明 five fingers,为什么手还是崩?

提示词只能提高概率,管不了结果。手指数量是采样过程中随机出来的,写了 five fingers 照样出六根。真正管用的是控制动作复杂度:让手插兜、搭在栏杆上、拿一件简单的物品,比摊开手掌可靠得多。

想给成图换个姿势,是垫图重跑还是重新画?

小改动垫图,大改动重画。垫图权重压在 0.4 以下能保住画风和服装,姿势只是微调;要是从站姿改成坐姿,结构整个变了,垫图只会把两张图的毛病叠在一起,不如重开。

延伸阅读