AI身材绘画怎么写不崩不擦边?八个体型词实测记录

AI身材绘画怎么写不崩不擦边?八个体型词实测记录
AI身材绘画体型词实测对比插画

我的判断是:AI身材绘画想稳,靠的不是换工具,是把「身材」这个词翻译成结构化的部位描述。八个常用体型词各跑十张的实测里,写结构词的组平均七张贴合,写印象词的组只有两张能看。

AI身材绘画这类需求,最近找我的特别多——健身教练要宣传图,做游戏的朋友要角色设定,还有想给自己画张理想身材参照图的。十个人里九个的第一版提示词都长一个样:「好身材」。

出来的图基本分两种。要么是个头肩比夸张到离谱的模特,要么干脆被平台拦了,提示一个「内容不适合生成」的红字。

问题出在哪?「身材」是个印象,不是结构。模型接不住印象,它只认得肩、腰、腿这些部位的写法。

为什么AI画身材总崩?

印象词没有几何信息,模型只能按训练数据里最抢眼的身材去凑,比例一乱就崩;敏感联想过重的词则直接触发审核,两类翻车根源不同。

先说崩图的。模型理解「好身材」的方式,是把数据里带这个标签的图平均一下,出来的往往是腰围缩到物理上不存在的程度。我拿「完美身材的男性」跑过十张,八张的肩宽超过身高的三分之一,教练看了直摇头,说这肩得练十年。

再说被拦的。写身材的时候往露骨方向靠,或者叠加一些暗示场景的词,审核模型一票否决,连解释的机会都没有。这个真没必要碰,写实身材出图本来就不缺那几个词。

我的经验是分两步走:先把印象词删掉,换成结构词,再把画面场景往「日常、运动、生活」上贴。同样一个人,写「健身房器械区做划船训练」和写一句模棱两可的场景,出图的通过率和贴合度完全是两个世界。

八个体型词实测:谁稳谁飘

十个词各出十张,写部位结构的词组平均七张贴合,写单一印象词的组平均两张;健壮、微胖、纤细三个词配合结构描述后稳定度最高。

我用同一工具、同一默认参数做了轮对照,每个词跑十张,统计贴合数(人物身材和预期一致、无明显畸形算贴合)。

写法贴合数备注
好身材2/10比例失控,腰肩失真
健壮5/10偏健美选手,日常感弱
宽肩窄腰、背阔肌线条清晰7/10教练认可度最高的一组
微胖3/10容易滑向网红减肥广告脸
圆润体型、脸颊饱满7/10微胖需求改写后明显变稳
娇小4/10常被理解成低龄化,慎用
身高一米五五、头身比六头身8/10数字一给,比例立刻听话

最意外的发现是「娇小」。这个词单独用,四成图往低龄方向跑,看得人心里发毛,我当场全删了。改成「身高一米五五、短发的成年女性」,十张里九张正常。年龄和身高这两个数字词,就是防止跑偏的锚。

还测了一组重绘幅度:局部修身材时,重绘幅度压到0.4以下,肩腰比例的崩图率从三成掉到一成左右;拉到0.75,改腰粗的同时手部开始乱长。改动幅度越大,崩的位置越多,这笔账要算清楚。

比例和身形怎么锁

锁比例靠三样:头身比写明数字、关键部位用几何词定位、服装给参照物,三个信息互相校验,模型跑偏的空间就小了。

头身比是最被低估的词。写「七头身」,出来的角色立刻比默认更像正常人;二次元风可以写「六头身」,Q版写「两头身到三头身」。这组数字我验证过,横跨二十张图,偏差都很小。

几何词管局部。肩写「平直的宽肩」,腿写「笔直」,腰写「收腰但不刻意」,比形容词靠谱。模型对几何形状的响应,比对「性感」「挺拔」这类虚词的响应强太多了。

服装和参照物是补丁。长裤能兜住腿部比例的失真,一件宽松卫衣能盖掉腰腹的奇怪弧线。画全身像的时候,我习惯让人物手里拿点东西——拎包、抱篮球、推单车,参照物一出现,整个人物的比例就有个托底的框。

最后一个习惯:出图后先看手腕和脚踝。这两处是最容易露馅的地方,粗细不对,整张图的身材可信度就塌了。别急着看脸,先看手脚。

健身房那张宣传图,最后用的是「宽肩窄腰、背阔肌线条清晰」加「器械区做划船训练」那一版,教练没提意见,直接拿去做了易拉宝。回头看,从「好身材」四个字走到成品,我实际只改了两次提示词。身材画不画得对,决定权一直在写词的人手里,这比抱怨模型笨有用得多。

常见问题

想让人物看起来更结实,又不想像健美运动员,词该怎么平衡?

别堆肌肉量词,改写运动状态。比如把「肌肉发达」换成「常年体力劳动的结实体型」或者「游泳运动员的肩背线条」,职业锚点一给,肌肉量会自动落在一个日常可接受的区间。

体型词会不会碰平台红线?

部位结构词加日常场景的组合很安全,我几十张图里没有一次被拦。会触发审核的是暗示性场景词和露骨修饰,把它们从词表里清掉就没事。

Q版或卡通风格还需要写头身比吗?

更需要。卡通风格没有真实人体做参照,头身比是唯一的比例锚,不写的话Q版经常飘成恐怖谷。两头身写「大圆头小身体」,比只写「可爱」可靠。

出图身材对了但脸丑,可以只重绘脸吗?

可以,局部重绘框住脸部,重绘幅度0.3到0.5之间试。注意框别太大,把脖子圈进去手部容易跟着变。

延伸阅读