ai绘画结构总崩?骨架、体块与裁剪线的分层提示词调法
别绕了:AI画崩结构不是手气差,是你没把结构信息喂给它。按体块朝向、关节衔接、裁剪线三层的顺序写提示词,再配一张姿态控制图,崩图率能从大半掉到两三成。我是联考过来的美术生,素描结构画了三年,转AI半年多,头一个月被各种反关节的图折磨到想摔键盘。这篇写的全是我怎么把画室里那套结构观察翻译成提示词的过程。
先说一个扎心的认知:模型不理解结构,它在预测像素。我们画室老师当年反复念叨"先大形后细节",是因为人知道胳膊长在肩窝上;模型不知道,它只知道"这类图里肩部旁边通常有一块肉色的像素"。大部分时候预测得挺像,可一旦你的描述和它的预测打架,结构就开始崩。理解了这一点,很多问题就好解释了——为什么加一堆精美细节词反而更容易崩,因为细节词把画面的算力都引走了,大形没人管了。
我现在的做法是把结构当成一等公民来写。一张图开画前,先花一分钟想清楚三个问题:这个人的体块各朝哪个方向、关节在哪些位置弯、衣服的布料从哪里搭下来。想不明白就自己摆个姿势拍张照,比硬憋提示词快。
AI为什么画不好结构:它在猜形状,不是搭骨架
模型靠像素统计猜形状,不认解剖学,描述与统计规律冲突时关节就反折、肌肉就错位,所以结构要靠分层信息和姿态控制去锚定。
理解了"猜"这个本质,你就能预判它会在哪儿崩。比例正常、姿势常规的图,统计数据里样本多,怎么画都对;一旦你要求"回眸过肩、手臂高举、深蹲",样本稀疏的地方就开始出错,肩关节反着折、腰拧出不可能的角度。我统计过自己头一个月的废图,六成以上崩在非常规姿势上,常规站姿反而很少出事。
所以对付结构的第一招不是堆词,是降难变通。"回眸过肩"容易崩,就改成"头微侧向左、肩部自然朝前",先拿七成效果,崩图风险砍掉一大半。真要极限姿势,就上姿态控制图,自己用手机拍或用火柴人摆一个,让骨架替你说话。这招让我那张蹲姿射箭的图起死回生,之前裸奔生成了十一张全废,挂上骨架一次过。
还有一条经验:结构崩点爱藏在被遮挡的部位。正面看着没事,一查背后手臂没了、腿穿裙子了。我的习惯是出图后放大检查关节拐点和遮挡交界处,背手、叉腰、插兜这三个姿势重点盯,出事率最高。
把结构喂进去:体块、关节、裁剪线三层的写法
提示词按三层排:先写体块朝向(肩线、胯部、头的转向),再写关节状态(手肘微曲、重心在左腿),最后写服装裁剪线,顺序别乱。
第一层体块,核心词是方向。"肩线右倾、胯部左顶、头部微抬"——把三大体块的朝向定死,人物的动态骨架就有了。别小看这三句,模型对朝向词的执行相当可靠,我实测比"动感姿势"这类空词强出几个量级。空词的下场是模型自由发挥,发挥成什么样全凭运气。
第二层关节,写弯曲不写角度。说"手肘微曲、膝盖并拢"就行,别写"手肘呈一百三十五度",模型对数字角度基本无感。重心词很好用,"重心落在右腿、左腿放松"一写,站姿立刻不僵。我头一个月的图全是双脚钉立的木桩站姿,加了重心词才治好。
第三层裁剪线,管的是衣服。衣料悬浮、缝线乱跑是结构问题的另一种形态,写清"公主线剪裁、肩部挺括、腰线收省"这种制版词,服装会服帖很多。面料跟身体的交叠关系也要交代,"裙摆随步态向右摆动、衣袖贴合小臂",布料有了走向,图里的衣服才像穿在人身上而不是糊上去的。写到脸型骨点和体态气质的关联,之前那篇讲老大气质的文章里有更细的拆法,骨相立住了皮相才稳。
三层写完还没完,重绘是最后的保险。结构只有一处小崩的时候,圈住那个关节,重绘幅度压到0.3左右慢慢磨。幅度一高,这块是改好了,旁边的手又融了,我吃过不下十次这个亏。
说回开头的判断:结构不是玄学,是信息给没给够。模型猜得再准,也架不住你什么都不说。体块、关节、裁剪线三层往下排,极限姿势挂骨架图,出图后盯死关节拐点——这套流程跑熟之后,我现在的废图率大概稳定在两成多,比起初那些反关节的惨案,已经是两个世界了。
常见问题
不装姿态控制插件,纯提示词能救结构吗?
小崩能救,大崩难。关节小错位靠局部重绘磨得平,整条胳膊反折的就别硬磨了,换姿势描述或者挂骨架图,时间成本更划算。
为什么我的图细节越多结构越崩?
细节词太多会把注意力引走,大形失守。我的比例是结构词和细节词大约四六开,结构词放在前面,先立骨架再谈装饰。
Q版或者变形风格还用管结构吗?
更省心,但不等于没有。Q版也有自己的比例规则,头身比一乱照样怪。写明"二头身、四肢圆润短粗",模型按这个规律猜,反而稳定。
群像图的结构怎么控制?
人越多统计越难,崩点成倍涨。能分区生成就分区,能少人就少人,我的上限一般压在四到五人,再多就不如分开画再合成。
结构词写太多会不会互相打架?
会。朝向词冲突时模型随机站队,比如又写头向左又写回眸向右,出来的脖子经常拧麻花。写完自己先读一遍,物理上做不到的姿势删掉。