绘画男生ai总画成网红脸?骨相、发型与少年感的实测调法
先把话放这:绘画男生ai最难的不是画质,是脸。我把同一套人物底稿配三种写法各跑十张,默认氛围词写法八张脸带硬伤,其中七张尖下巴;骨相、发型、眼神拆开逐项调之后,硬伤只剩两张。建议先抄第三节的对照表,再按自己翻车的部位逐项改。
绘画男生ai出图,翻车几乎都翻在同一批地方:下巴越来越尖,眼神越来越油,头发糊成一顶帽子。我起初以为是模型不行,换了两个引擎重跑,问题原样复现。后来把提示词一句句拆开对照,才确认九成是写法的问题,跟运气关系不大。
依据是我自己做的一组小实验。同一套人物底稿,设定不动,只换脸、发、眼神三处的描述词,每种写法各跑十张,数尖下巴、油腻眼神、发丝清晰的张数。三十张跑完,规律相当清楚:帅、酷、迷人这类氛围词,就是把男生往网红脸方向推的手。下面按部位拆开讲。
骨相:先把尖下巴压下去
男生骨相要靠方下颌、眉骨、颧骨三个结构词锚定,只写帅气必翻车。我实测加下方下颌一词后,十张里尖下巴从七张掉到两张。
具体改法:在 handsome young man 后面补上 sharp jawline、defined brow bone、slightly high cheekbones。这三个词是我一次翻车后逐个试出来的,缺一个,尖下巴率就往上抬一截。
我试了下只加 sharp jawline 一个词,十张里仍有三张尖下巴,但形状已经从锥子变成了正常下颌。三个词一起上,偏尖的只剩两张,代价是有一张方得像中年大叔。那张的修法是在词尾补 softened features,把棱角磨回来一点。
还有一个坑要说。年龄词千万别省。我不写年龄的那组,模型经常把骨相往二十五六岁画,法令纹都出来了。补上 19 years old 之后,少年感和方下颌能同时立住。说实话,这一步是我赌气试出来的,本以为没用,结果十张里九张年龄感对了。
发型与眼神:少年感的两个开关
发型写结构不写氛围,眼神靠视线方向加瞳孔高光一起压。氛围词十张糊八张,结构词能把发丝走向立起来。
先说发型。帅、利落、干净这类词放在男生头发上几乎不起作用,模型不知道你说的利落长什么样。结构词才有用:layered short hair(层次短发)、small cowlick(发旋翘起)、short temples(鬓角剪短)。我用结构词那组,十张里七张能数出发丝走向;用氛围词那组,八张糊成一整块。
眼神是另一半。默认提示词里常见的 intense eyes、sparkling eyes,我个人的判断是这俩就是油腻的源头,模型会把它们理解成卧蚕加大、瞳孔高光拉满。换成 looking slightly away(视线偏开)加 small catchlight(小高光),油腻感立刻下去,十张里只剩一张油。
话说回来,眼神这东西有点玄学。同样两个词,配正脸就油,配四分之三侧脸就干净。后来我干脆把四分之三侧脸写进固定底稿,省心。废图率也从四成掉到一成半左右。
三十张实测账:三种写法放在一张表里
三种写法各跑十张:氛围词组八张脸带硬伤,脸和头发换结构词后降到六张,全套写法只剩两张。逐项换词,别整句重写。
把三组数据放一起看更直观。
| 写法 | 尖下巴 | 油腻眼神 | 脸带硬伤 | 发丝清晰 |
|---|---|---|---|---|
| 只写氛围词(帅气、冷酷) | 7/10 | 6/10 | 8/10 | 2/10 |
| 氛围词加骨相与发型结构词 | 2/10 | 5/10 | 6/10 | 7/10 |
| 再加年龄、视线方向、小高光 | 1/10 | 1/10 | 2/10 | 8/10 |
表里有个细节要交代:第二组眼神还是油,因为那组我没动眼神词。三组词是叠加关系,不是三选一。这也解释了为什么不少人喊调了没用——只调一处,另一处的坑还开着。
场景和服装顺带提一句。个人觉得男生图的背景宜简不宜繁,我试过把剑气、光效全堆上去,人物脸反而被吃掉了。想把气场往上抬一档,可以看这篇纵横ai绘画的气势从哪来:剑气与横幅大场面实测,讲的就是大场面里光和构图的分寸。先把脸立住,再谈场面。
回到开头那句话:绘画男生ai翻车翻在脸,修法也就落在脸。骨相三个词、发型三个词、眼神两个词,拢共十来个词组,比换引擎、堆采样步数都管用。我那三十张的账就摆在这,八张硬伤和两张硬伤之间的差距,就是这几处改词。先抄表,再逐项换,跑五张看均值,别凭一张定生死。
常见问题
男生脸总是太俊秀,怎么画出硬朗一点的感觉?
把皮肤和体格词改粗一档:加 light stubble(淡胡茬)、rough skin texture,再写肩宽和手部姿态。胡茬是最好用的硬朗开关,一加就有,想减龄就换浅色短茬。
跑出来年龄感忽大忽小怎么办?
年龄词要和骨相词、道具词绑在一起用,单写 19 years old 有时会被场景词冲掉。我现在的固定底稿是年龄加高中教室背景,十张里九张年龄稳定。
提示词写中文还是英文,差别大吗?
脸、骨相这类精细部位,我实测英文命中率更高,中文容易偏意译糊掉。场景、情绪用中文反而自然。混着写不丢人,哪个准用哪个。
同一组提示词为什么每次出的脸都不一样?
采样随机性决定的,正常现象。看中哪张脸就用种子值固定住,之后只微调发型服装词,脸就不会崩。